Passer au contenu principal
Le point de terminaison Olostep /v1/searches vous permet de rechercher sur le web avec une requête en langage naturel et de recevoir une liste dédupliquée de liens pertinents avec des titres et des descriptions.
  • Envoyez une requête en anglais simple
  • Recevez des liens structurés de tout le web
  • Optionnellement, récupérez chaque URL retournée en un seul aller-retour et intégrez markdown_content / html_content directement dans la réponse
  • Filtrez par domaine, contrôlez le nombre de résultats et limitez le temps de récupération
Il recherchera la requête de manière sémantique sur le web et renverra les résultats. Pour les détails de l’API, consultez la Référence de l’API du point de terminaison de recherche.

Installation

Utilisation de base

Envoyez une requête en langage naturel et recevez une liste de liens pertinents.

Paramètres de la requête

Limiter le nombre de résultats

Filtrer par domaine

include_domains restreint les résultats à une liste blanche; exclude_domains filtre les sources indésirables. Ils peuvent être combinés.

scrape_options

Passez scrape_options pour récupérer chaque URL retournée en parallèle et intégrer le contenu rendu directement sur chaque lien. Cela économise un aller-retour par résultat par rapport à l’appel de /v1/searches et /v1/scrapes séparément.

Comportement

  • Tous les liens sont récupérés en parallèle. Le timeout limite l’ensemble du lot, pas chaque lien individuel.
  • Les échecs de récupération par lien (erreurs réseau, délais d’attente de page individuelle) laissent le markdown_content / html_content de ce lien à null tandis que les autres liens retournent normalement.
  • Si le timeout global expire avant que toutes les récupérations ne soient terminées, la recherche répond immédiatement avec les liens qu’elle a — les récupérations déjà terminées conservent leur contenu; celles en cours reviennent avec un contenu null.
  • Pour les URLs reddit.com/.../comments/..., la requête est automatiquement acheminée via le parseur @olostep/reddit-post et le JSON structuré est rendu en markdown propre + HTML basique.
  • Si le contenu en ligne combiné dépasse 9MB, les champs de contenu sont annulés, result.size_exceeded est défini à true, et vous pouvez récupérer la charge utile complète depuis result.json_hosted_url.

Exemple avec récupération

Réponse

Vous recevrez un objet search en réponse. L’objet search contient un id, votre query original, credits_consumed, et un result avec une liste de links.
Chaque lien dans result.links contient : Le résultat complet est également disponible sous forme de fichier JSON hébergé à result.json_hosted_url — utile lorsque result.size_exceeded est true.

Récupérer une recherche passée

GET /v1/searches/{search_id} retourne ce qui a été conservé au moment de la recherche, y compris tout contenu récupéré. C’est une lecture idempotente pure — pas de nouvelle récupération, pas de nouvelle facturation. Les recherches plus anciennes sans scrape_options n’ont simplement pas de champs de contenu par lien.
Voir Get Search pour plus de détails.

Tarification

Chaque recherche coûte 5 crédits pour la recherche elle-même. Lorsque scrape_options est fourni, chaque page récupérée est facturée au tarif standard /v1/scrapes (généralement 1 crédit par page; certains parseurs coûtent plus cher). Le total est retourné dans credits_consumed. Exemples :