Introduzione
L’SDK NodeJS accetta entrambi i formati camelCase e snake_case per tutti i parametri. Usa snake_case se stai sviluppando per agenti AI, corrisponde ai nomi dei campi nativi dell’API.
Utilizzo
Scraping
Esegui lo scraping di un singolo URL con varie opzioni:Elaborazione in batch
Elabora più URL in un unico batch:Crawling
Esegui il crawling di un intero sito web:Mappatura del sito
Genera una sitemap degli URL da un sito web:Risposte potenziate dall’AI
Ottieni risposte dalle pagine web usando l’AI:Recupero del contenuto
Recupera contenuti precedentemente estratti:Opzioni avanzate
Azioni personalizzate
Esegui azioni del browser prima dello scraping:Posizione geografica
Esegui lo scraping da diversi paesi utilizzando codici paese predefiniti o qualsiasi stringa di codice paese valida:Caching
Per impostazione predefinita, ogni richiesta di scraping recupera la pagina fresca (max_age: 0). Passa maxAge per riutilizzare un risultato recente con gli stessi parametri e migliorare il tempo di risposta. Il valore è in secondi; il massimo è 7 giorni (604800). Vedi Caching per i dettagli.
Estrazione LLM
Estrai dati strutturati utilizzando LLM:Configurazione del client
Caratteristiche principali
- Client orientato all’asincronia con pieno supporto TypeScript.
- Input sicuri con TypeScript utilizzando enum e interfacce (Formats, Countries, Actions, ecc.).
- Namespace delle risorse ricchi con chiamate abbreviate (
client.scrapes.create()) e metodi espliciti (client.scrapes.get()). - Livello di trasporto condiviso con retry, timeout e decodifica JSON.
- Gerarchia completa degli errori