/v1/searches te permite buscar en la web con una consulta en lenguaje natural y obtener una lista deduplicada de enlaces relevantes con títulos y descripciones.
- Envía una consulta en inglés sencillo
- Recibe enlaces estructurados de toda la web
- Opcionalmente, raspa cada URL devuelta en un solo viaje de ida y vuelta e incrusta
markdown_content/html_contentdirectamente en la respuesta - Filtra por dominio, controla el número de resultados y limita el tiempo de raspado
Instalación
Uso básico
Envía una consulta en lenguaje natural y recibe una lista de enlaces relevantes.Parámetros de la solicitud
Limitando el número de resultados
Filtrando por dominio
include_domains limita los resultados a una lista blanca; exclude_domains filtra las fuentes no deseadas. Se pueden combinar.
scrape_options
Pasascrape_options para raspar cada URL devuelta en paralelo e incrustar el contenido renderizado directamente en cada enlace. Esto ahorra un viaje de ida y vuelta por resultado en comparación con llamar a /v1/searches y /v1/scrapes por separado.
Comportamiento
- Todos los enlaces se raspan en paralelo. El
timeoutlimita todo el lote, no cada enlace individual. - Los fallos de raspado por enlace (errores de red, tiempos de espera individuales de página) dejan el
markdown_content/html_contentde ese enlace comonullmientras que otros enlaces se devuelven normalmente. - Si el
timeoutglobal expira antes de que todos los raspados terminen, la búsqueda responde inmediatamente con los enlaces que tiene — los raspados ya completados mantienen su contenido; los que están en proceso regresan con contenidonull. - Para URLs de
reddit.com/.../comments/..., la solicitud se enruta automáticamente a través del analizador@olostep/reddit-posty el JSON estructurado se renderiza en markdown limpio + HTML básico. - Si el contenido combinado en línea excede los 9MB, los campos de contenido se anulan,
result.size_exceededse establece entrue, y puedes obtener la carga completa desderesult.json_hosted_url.
Ejemplo con raspado
Respuesta
Recibirás un objetosearch en respuesta. El objeto search contiene un id, tu query original, credits_consumed, y un result con una lista de links.
result.links contiene:
El resultado completo también está disponible como un archivo JSON alojado en
result.json_hosted_url — útil cuando result.size_exceeded es true.
Recuperando una búsqueda pasada
GET /v1/searches/{search_id} devuelve lo que se guardó en el momento de la búsqueda, incluyendo cualquier contenido raspado. Es una lectura idempotente pura — sin nuevo raspado, sin nueva facturación. Las búsquedas antiguas sin scrape_options simplemente no tienen campos de contenido por enlace.
Precios
Cada búsqueda cuesta 5 créditos por la búsqueda en sí. Cuando se proporcionascrape_options, cada página raspada se factura a la tarifa estándar de /v1/scrapes (típicamente 1 crédito por página; algunos analizadores cuestan más). El total se devuelve en credits_consumed.
Ejemplos: