Erste Schritte
Das NodeJS SDK akzeptiert sowohl camelCase als auch snake_case für alle Parameter. Verwende snake_case, wenn du für KI-Agenten entwickelst, da es den nativen Feldnamen der API entspricht.
Verwendung
Scraping
Scrape eine einzelne URL mit verschiedenen Optionen:Batch-Verarbeitung
Verarbeite mehrere URLs in einem einzigen Batch:Crawling
Durchsuche eine gesamte Website:Site Mapping
Erstelle eine Sitemap von URLs einer Website:KI-gesteuerte Antworten
Erhalte Antworten von Webseiten mithilfe von KI:Inhalt abrufen
Rufe zuvor gescrapten Inhalt ab:Erweiterte Optionen
Benutzerdefinierte Aktionen
Führe Browseraktionen vor dem Scraping aus:Geografischer Standort
Scrape aus verschiedenen Ländern mit vordefinierten Ländercodes oder einem beliebigen gültigen Ländercode-String:Caching
Standardmäßig holt jede Scrape-Anfrage die Seite frisch ab (max_age: 0). Übergebe maxAge, um ein kürzliches Ergebnis mit denselben Parametern wiederzuverwenden und die Antwortzeit zu verbessern. Der Wert ist in Sekunden; das Maximum beträgt 7 Tage (604800). Siehe Caching für Details.
LLM-Extraktion
Extrahiere strukturierte Daten mithilfe von LLMs:Client-Konfiguration
Funktionshighlights
- Asynchroner Client mit vollständiger TypeScript-Unterstützung.
- Typsichere Eingaben mit TypeScript-Enums und -Interfaces (Formate, Länder, Aktionen usw.).
- Umfangreiche Ressourcennamensräume mit sowohl Kurzaufrufen (
client.scrapes.create()) als auch expliziten Methoden (client.scrapes.get()). - Gemeinsame Transportschicht mit Wiederholungen, Zeitüberschreitungen und JSON-Decodierung.
- Umfassende Fehlerhierarchie