Pour commencer
Le SDK NodeJS accepte à la fois camelCase et snake_case pour tous les paramètres. Utilise snake_case si tu développes pour des agents IA, cela correspond aux noms de champs natifs de l’API.
Utilisation
Scraping
Scrape une URL unique avec diverses options :Traitement par lot
Traite plusieurs URLs dans un seul lot :Exploration
Explore un site web entier :Cartographie du site
Génère une carte des URLs d’un site web :Réponses alimentées par l’IA
Obtiens des réponses à partir de pages web en utilisant l’IA :Récupération de contenu
Récupère le contenu précédemment extrait :Options avancées
Actions personnalisées
Effectue des actions de navigateur avant le scraping :Localisation géographique
Scrape depuis différents pays en utilisant des codes pays prédéfinis ou tout code pays valide :Mise en cache
Par défaut, chaque requête de scraping récupère la page fraîche (max_age: 0). Passe maxAge pour réutiliser un résultat récent avec les mêmes paramètres et améliorer le temps de réponse. La valeur est en secondes ; le maximum est de 7 jours (604800). Voir Mise en cache pour plus de détails.
Extraction LLM
Extrait des données structurées en utilisant des LLM :Configuration du client
Points forts des fonctionnalités
- Client asynchrone avec prise en charge complète de TypeScript.
- Entrées sûres grâce à TypeScript avec des énumérations et interfaces (Formats, Pays, Actions, etc.).
- Espaces de noms riches en ressources avec des appels abrégés (
client.scrapes.create()) et des méthodes explicites (client.scrapes.get()). - Couche de transport partagée avec reprises, délais d’attente et décodage JSON.
- Hiérarchie d’erreurs complète