接口说明: 通过API从Yandex获取实时搜索数据。
请求地址:https://scraperapi.dataify.com/request
请求方式: POST
Headers:
| 参数名称 | 参数类型 | 是否必须 | 描述 |
|---|---|---|---|
| Authorization | string | 必须 | 固定格式:Authorization: Bearer <你的token>。token 在仪表板 → 设置 → Token管理获取。不支持自定义 token 请求头。 |
Body:
| 参数名称 | 参数类型 | 是否必须 | 描述 |
|---|---|---|---|
engine | string | 是 | 目标搜索引擎,固定为 yandex。 |
text | string | 是 | 定义用于爬取的搜索查询(默认:q=pizza)。完整清单 |
json | string | 否 | 此参数定义爬取结果的输出格式:
json=1 表示 JSON 格式,
json=2 表示同时输出两种格式,
json=3 表示 HTML 格式。 |
yandex_domain | string | 否 | 指定爬取的域名(默认值:yandex.com) |
lang | string | 否 | 此参数定义搜索结果的语言。可能值清单请参阅lang参数 |
lr | string | 否 | 此参数定义搜索结果的语言范围。可能值清单请参阅lr参数 |
rstr | string | 否 | 强制结果匹配指定区域(lr)或启用安全搜索过滤,取值透传(strict/off 等可正常传入)。注意:family 实测返回 400 已失效。 |
p | string | 否 | 分页控制(从 p=0 开始),必须与每页结果数参数搭配使用。可能值清单请参阅页面参数。 |
within | string | 否 | 指定搜索时间范围,取值透传给 Yandex。注:旧文档所列 77/2/7 等值实测返回 400 已失效;90、2w、1m 等可正常传入,具体语义以 Yandex 官方日期参数为准。 |
{
"code": 200,
"spider_parameter": {
"engine": "yandex",
"device": "desktop",
"domain": "https://yandex.com/",
"text": "pizza",
"render_js": false,
"render_png": false
},
"search_metadata": {
"id": "nvpop2facwdliufspdp37hquycc2w483",
"spider_url": "https://yandex.com/search?text=pizza",
"total_time_taken": 4.5625,
"created_at": "2026-09-08 10:15:01",
"processed_at": "2026-09-08 10:15:06",
"status": "Success"
},
"search_information": {
"query_displayed": "pizza",
"yandex_results_state": "Results for exact spelling"
},
"organic_results": [
{
"title": "...",
"position": 1,
"link": "https://...",
"description": "..."
}
],
"pagination": {}
}
| 参数名称 | 参数类型 | 是否必返 | 描述 |
|---|---|---|---|
code | int | 是 | 业务状态码,200 表示成功 |
spider_parameter | object | 是 | 实际生效的请求参数:engine/device/domain/text/render_js/render_png |
search_metadata | object | 是 | 搜索元数据(id/spider_url/status/created_at/processed_at/total_time_taken) |
search_information | object | 是 | 搜索信息(query_displayed/yandex_results_state) |
organic_results | array | 是 | 自然搜索结果列表(元素含 title/position/link/description) |
pagination | object | 否 | 分页信息 |