/v1/searches ermöglicht es dir, das Web mit einer natürlichen Sprachabfrage zu durchsuchen und eine deduplizierte Liste relevanter Links mit Titeln und Beschreibungen zurückzubekommen.
- Sende eine Abfrage in einfachem Englisch
- Erhalte strukturierte Links aus dem gesamten Web
- Optional kannst du jede zurückgegebene URL in einem Durchgang scrapen und
markdown_content/html_contentdirekt in die Antwort einbetten - Filtere nach Domain, kontrolliere die Anzahl der Ergebnisse und begrenze die Scraping-Wallclock
Installation
Grundlegende Nutzung
Sende eine Abfrage in natürlicher Sprache und erhalte eine Liste relevanter Links.Anfrageparameter
Begrenzung der Anzahl der Ergebnisse
Filtern nach Domain
include_domains beschränkt Ergebnisse auf eine Whitelist; exclude_domains filtert unerwünschte Quellen heraus. Sie können kombiniert werden.
scrape_options
Übergebescrape_options, um jede zurückgegebene URL parallel zu scrapen und den gerenderten Inhalt direkt auf jedem Link einzubetten. Dies spart eine Rundreise pro Ergebnis im Vergleich zum separaten Aufrufen von /v1/searches und /v1/scrapes.
Verhalten
- Alle Links werden parallel gescrapt. Der
timeoutbegrenzt das gesamte Batch, nicht jeden einzelnen Link. - Bei Scrape-Fehlern pro Link (Netzwerkfehler, individuelle Seitenauszeiten) bleibt der
markdown_content/html_contentdieses Linksnull, während andere Links normal zurückgegeben werden. - Wenn der globale
timeoutabläuft, bevor alle Scrapes abgeschlossen sind, antwortet die Suche sofort mit den Links, die sie hat — bereits abgeschlossene Scrapes behalten ihren Inhalt; in Bearbeitung befindliche kommen mitnullInhalt zurück. - Für
reddit.com/.../comments/...URLs wird die Anfrage automatisch durch den@olostep/reddit-postParser geleitet und das strukturierte JSON wird in sauberes Markdown + einfaches HTML gerendert. - Wenn der kombinierte Inline-Inhalt 9MB überschreitet, werden Inhaltsfelder genullt,
result.size_exceededwird auftruegesetzt und du kannst die vollständige Nutzlast vonresult.json_hosted_urlabrufen.
Beispiel mit Scraping
Antwort
Du erhältst einsearch-Objekt als Antwort. Das search-Objekt enthält eine id, deine ursprüngliche query, credits_consumed und ein result mit einer Liste von links.
result.links enthält:
Das vollständige Ergebnis ist auch als gehostete JSON-Datei unter
result.json_hosted_url verfügbar — nützlich, wenn result.size_exceeded true ist.
Abrufen einer vergangenen Suche
GET /v1/searches/{search_id} gibt alles zurück, was zum Zeitpunkt der Suche gespeichert wurde, einschließlich aller gescrapten Inhalte. Es ist ein reiner idempotenter Lesevorgang — kein erneutes Scraping, keine erneute Abrechnung. Ältere Suchen ohne scrape_options haben einfach keine Inhaltsfelder pro Link.
Preisgestaltung
Jede Suche kostet 5 Credits für die Suche selbst. Wennscrape_options angegeben ist, wird jede gescrapte Seite zum Standardtarif von /v1/scrapes abgerechnet (typischerweise 1 Credit pro Seite; einige Parser kosten mehr). Die Gesamtsumme wird in credits_consumed zurückgegeben.
Beispiele: