Was du bauen kannst
Website scrapen
Extrahiere Inhalte von jeder einzelnen URL in Markdown, HTML, JSON oder Text
URLs im Batch scrapen
Verarbeite große Listen von URLs parallel mit strukturierten Ausgaben
Crawl erstellen
Entdecke und scrape verlinkte Seiten, um vollständige Datensätze zu erstellen
Karte erstellen
Extrahiere alle URLs von einer Website (sitemap-ähnliche Entdeckung)
KI-gestützte Antworten
Stelle Fragen und erhalte strukturierte JSON-Antworten mit Quellen
Schnellstart
1) Installiere Apify CLI
2) Hol dir deinen Olostep API-Schlüssel
Vom Olostep Dashboard → API-Schlüssel.3) Führe den Olostep Actor lokal aus
olostep-tools/integrations/apify/storage/key_value_stores/default/INPUT.json
Beispiel-Eingabe:
4) Auf Apify (Cloud) bereitstellen
Ausführung in der Apify-Konsole (Schritt für Schritt)
- Öffne deinen Actor in der Apify-Konsole → Quelle → Eingabe.
- Im Tab “Manuell” siehst du ein sichtbares Feld “Olostep API-Schlüssel”. Füge deinen Schlüssel vom Olostep Dashboard ein.
- Wähle eine Operation (Standard ist “scrape”).
- Fülle die relevanten Felder aus (für “scrape”, setze “URL zum Scrapen”).
- Klicke auf Speichern → Start.
- Wenn der Lauf beendet ist, öffne den Dataset-Tab, um die Ergebnisse herunterzuladen (JSON/CSV/Excel).
- Für “URL zum Scrapen” kannst du mit oder ohne Schema einfügen. Wenn es fehlt, fügt der Actor automatisch
https://hinzu. - Wenn eine Seite viel JavaScript enthält und du ein Timeout siehst, setze “Wartezeit vor dem Scrapen” auf 2000–5000 ms und führe es erneut aus.
Verfügbare Operationen
Website scrapen
Extrahiere Inhalte von einer einzelnen URL. Ideal für Automatisierung auf Seitenebene.constant
Standard:"scrape"
Muss “scrape” sein
string
erforderlich
Dein Olostep API-Schlüssel (Bearer)
string
erforderlich
Die zu scrapende URL (muss http:// oder https:// enthalten)
dropdown
Standard:"markdown"
Eine von: Markdown, HTML, JSON, Text
string
Optionaler Ländercode (z.B. “US”, “GB”, “CA”)
integer
Optionale Wartezeit in ms für JavaScript-Rendering (0–10000)
string
Optionale Parser-ID (z.B. “@olostep/amazon-product”)
- id, url, status, formats
- markdown_content / html_content / json_content / text_content
- gehostete URLs (falls verfügbar), Seitenmetadaten
URLs im Batch scrapen
Verarbeite viele URLs gleichzeitig mit konsistenter Formatierung und Struktur.constant
Standard:"batch"
Muss “batch” sein
string
erforderlich
Dein Olostep API-Schlüssel
text
erforderlich
JSON-Array von Objekten mit
Beispiel:
url und optionalem custom_idBeispiel:
[{"url":"https://example.com","custom_id":"site1"}]dropdown
Standard:"markdown"
Eine von: Markdown, HTML, JSON, Text
string
Optionaler Ländercode
integer
Optionale Wartezeit in ms für JS-Seiten
string
Optionale Parser-ID
- batch_id, status, total_urls, created_at, formats, country, parser, urls[]
Crawl erstellen
Folge Links und scrape mehrere Seiten von einer Start-URL.constant
Standard:"crawl"
Muss “crawl” sein
string
erforderlich
Dein Olostep API-Schlüssel
string
erforderlich
Start-URL für den Crawl
integer
Standard:"10"
Maximale Seitenanzahl zum Crawlen. Setze auf
1, um nur die Start-URL zu scrapen.dropdown
Standard:"markdown"
Eine von: Markdown, HTML, JSON, Text
string
Optionaler Ländercode
string
Optionale Parser-ID
- crawl_id, object, status, start_url, max_pages, created, formats
Karte erstellen
Entdecke alle URLs auf einer Website und bereite sie für späteres Batch-Scraping vor.constant
Standard:"map"
Muss “map” sein
string
erforderlich
Dein Olostep API-Schlüssel
string
erforderlich
Die zu kartierende Website
string
Optionale Abfragefilter
integer
Begrenze die Anzahl der URLs
string
Einzuschließende Globs, z.B. “/products/**”
string
Auszuschließende Globs, z.B. “/admin/**”
- map_id, object, website_url, total_urls, urls[], search_query, top_n
JSON-Beispiele kopieren und einfügen (Konsole → Eingabe → JSON)
Scrape
Batch
Crawl
Map
Answers
Beispiel-Workflows
Produkte entdecken und scrapen
Produkte entdecken und scrapen
- Karte erstellen → “/products/**” einbeziehen
- URLs parsen → Batch-Array erstellen
- URLs im Batch scrapen → Formate: JSON
- An Google Sheets / Airtable senden
Tägliche Inhaltsüberwachung
Tägliche Inhaltsüberwachung
- Actor planen (täglich)
- Website scrapen → Formate: Markdown
- Mit LLM zusammenfassen
- Benachrichtigung auf Slack
Wissensdatenbank des Wettbewerbers
Wissensdatenbank des Wettbewerbers
- Crawl erstellen (Blog/Dokumente)
- Ausgaben in Notion speichern
- Wöchentlich mit Zeitplan aktualisieren
Spezialisierte Parser
Olostep unterstützt Parser, um Daten für beliebte Seiten zu strukturieren.Amazon-Produkt
@olostep/amazon-product → Titel, Preis, Bewertung, Rezensionen, Bilder, VariantenGoogle-Suche
@olostep/google-search → Ergebnisse, Titel, Snippets, URLsGoogle Maps
@olostep/google-maps → Geschäftsinformationen, Rezensionen, Bewertungen, StandortWeitere Parser
Entdecke E-Mail-Extraktoren, Social-Handle-Finder, Kalender-Link-Extraktoren und mehr
Beste Praktiken
Bevorzuge Batch für 3+ URLs
Bevorzuge Batch für 3+ URLs
Schneller, günstiger, einfacher zu überwachen und respektiert Ratenlimits.
Verwende angemessene Wartezeiten
Verwende angemessene Wartezeiten
JS-lastige Seiten: erhöhe
wait_before_scraping (z.B. 2000–5000ms).Filtere vor dem Scrapen
Filtere vor dem Scrapen
Vermeide unnötige Aufgaben — überprüfe zuerst Änderungen, halte den Deduplizierungszustand.
Speichere große Inhalte über gehostete URLs
Speichere große Inhalte über gehostete URLs
Verwende gehostete Ausgaben, um Größenbeschränkungen für Nutzlasten in Apify-Flows zu umgehen.
Behandle asynchrone Operationen als langlaufend
Behandle asynchrone Operationen als langlaufend
Batch/Crawl/Map geben IDs zurück; später abrufen oder mit Verzögerung verketten.
Behandle vorübergehende Timeouts sauber
Behandle vorübergehende Timeouts sauber
Wenn du einen 504 oder vorübergehenden Timeout siehst, versucht der Actor automatisch einmal mit einer kurzen Wartezeit erneut.
Du kannst auch “Wartezeit vor dem Scrapen” auf 2000–5000 ms für JS-lastige Seiten setzen.
Du kannst auch “Wartezeit vor dem Scrapen” auf 2000–5000 ms für JS-lastige Seiten setzen.
Fehlerbehebung
Authentifizierung fehlgeschlagen
Authentifizierung fehlgeschlagen
- Überprüfe den API-Schlüssel vom Dashboard
- Entferne nachfolgende Leerzeichen
- Erneut im Apify-Eingabeformular eingeben
Leerer Inhalt
Leerer Inhalt
- Wartezeit erhöhen
- Überprüfe, ob die URL öffentlich ist / nicht login-geschützt
- Versuche ein anderes Ausgabeformat
Ratenlimit überschritten
Ratenlimit überschritten
- Läufe über Zeitplan verteilen
- Bevorzuge Batch für viele URLs
- Upgrade des Olostep-Plans bei Bedarf
Blockierte oder dynamische Seiten
Blockierte oder dynamische Seiten
- Versuche den Länderparameter
- Passe Wartezeit und Parser an
- Kontaktiere den Support für Anleitungen
Preisgestaltung
Olostep berechnet nach API-Nutzung (unabhängig von Apify):- Scrapes → pro Scrape
- Batches → pro URL
- Crawls → pro Seite
- Maps → pro Operation
https://www.olostep.com/pricing.
Sicherheit
- Dein API-Schlüssel wird zur Laufzeit als Bearer-Token gesendet.
- Schlüssel nicht in die Versionskontrolle einchecken; Apify speichert Eingaben im Key-Value Store.
- In der lokalen Entwicklung, halte Schlüssel in
storage/key_value_stores/default/INPUT.json(gitignoriert).
Verwandte Ressourcen
Scrapes API
Extrahiere LLM-freundliches Markdown, HTML, Text oder strukturiertes JSON von jeder URL.
Batches API
Verarbeite bis zu 10k URLs gleichzeitig und rufe Ergebnisse später ab.
Crawls API
Entdecke und scrape den Inhalt einer Seite rekursiv.
Maps API
Erhalte alle URLs auf einer Website, um Batch-Scrapes vorzubereiten.
Support
Apify Website
Apify-Plattform
Apify Docs
Apify-Plattform & SDK-Dokumentation
Dokumentation
Vollständige API-Dokumentation