/v1/searches 端点允许你使用自然语言查询搜索网络,并返回去重的相关链接列表,包含标题和描述。
- 使用简单的英语发送查询
- 从整个网络获取结构化链接
- 可选地在一次往返中抓取每个返回的 URL,并将
markdown_content/html_content直接嵌入响应中 - 按域名过滤,控制结果数量,并限制抓取的时间
安装
基本用法
发送自然语言查询并接收相关链接列表。请求参数
限制结果数量
按域名过滤
include_domains 将结果限制在白名单内;exclude_domains 过滤掉不需要的来源。它们可以结合使用。
scrape_options
传递scrape_options 以并行抓取每个返回的 URL,并将渲染的内容直接嵌入每个链接中。与分别调用 /v1/searches 和 /v1/scrapes 相比,这节省了每个结果的往返。
行为
- 所有链接并行抓取。
timeout限制整个批次,而不是每个单独的链接。 - 每个链接的抓取失败(网络错误、单个页面超时)会使该链接的
markdown_content/html_content为null,而其他链接正常返回。 - 如果全局
timeout在所有抓取完成之前到期,搜索会立即响应已完成的链接 — 已完成的抓取保留其内容;进行中的抓取返回null内容。 - 对于
reddit.com/.../comments/...URL,请求会自动通过@olostep/reddit-post解析器路由,并将结构化 JSON 渲染为干净的 markdown + 基本 HTML。 - 如果组合的内联内容超过 9MB,内容字段将为空,
result.size_exceeded设置为true,你可以从result.json_hosted_url获取完整的负载。
带抓取的示例
响应
你将收到一个search 对象作为响应。search 对象包含一个 id,你的原始 query,credits_consumed,以及一个包含 links 列表的 result。
result.links 中的每个链接包含:
完整结果也可以作为托管 JSON 文件在
result.json_hosted_url 获取 — 当 result.size_exceeded 为 true 时非常有用。
检索过去的搜索
GET /v1/searches/{search_id} 返回在搜索时保存的内容,包括任何抓取的内容。这是一个纯粹的幂等读取 — 无需重新抓取,无需重新计费。没有 scrape_options 的旧搜索没有每个链接的内容字段。
价格
每次搜索花费 5 个积分。 当提供scrape_options 时,每个抓取的页面按标准 /v1/scrapes 费率计费(通常每页 1 个积分;某些解析器费用更高)。总费用在 credits_consumed 中返回。
示例: