Skip to main content
NPM 包: olostep

入门

NodeJS SDK 接受所有参数的 camelCasesnake_case。如果你是为 AI 代理构建,请使用 snake_case,它与 API 的原生字段名称匹配。

用法

抓取

使用各种选项抓取单个 URL:

批量处理

在一个批次中处理多个 URL:

爬取

爬取整个网站:

网站映射

从网站生成 URL 的站点地图:

AI 驱动的答案

使用 AI 从网页获取答案:

内容检索

检索先前抓取的内容:

高级选项

自定义操作

在抓取前执行浏览器操作:

地理位置

使用预定义的国家代码或任何有效的国家代码字符串从不同国家抓取:

缓存

默认情况下,每个抓取请求都会获取最新页面(max_age: 0)。传递 maxAge 以重用具有相同参数的最近结果并提高响应时间。值为 ;最大为 7 天(604800)。详情见 缓存

LLM 提取

使用 LLM 提取结构化数据:

客户端配置

功能亮点

  • 以异步为主的客户端,全面支持 TypeScript。
  • 使用 TypeScript 枚举和接口(格式、国家、操作等)进行类型安全输入。
  • 丰富的资源命名空间,提供简写调用(client.scrapes.create())和显式方法(client.scrapes.get())。
  • 共享传输层,支持重试、超时和 JSON 解码。
  • 全面的错误层次结构。