Skip to main content

Überblick

Anstatt die gesamte Website zu kartieren, möchtest du dich vielleicht auf bestimmte Abschnitte konzentrieren. In diesem Leitfaden zeigen wir dir, wie du nur die Blog-URLs von Stripes Website extrahierst.

Nur Blog-URLs extrahieren

Um nur die Blog-URLs von Stripes Website zu extrahieren, verwende den Maps-Endpunkt mit Pfadmusterfiltern. Der Parameter include_urls ermöglicht es dir, genau anzugeben, welche URL-Muster du in den Ergebnissen einschließen möchtest.

Die URL-Muster verstehen

Im obigen Beispiel verwenden wir zwei Musterspezifikationen:
  • /blog - Entspricht genau der Hauptblogseite (https://stripe.com/blog)
  • /blog/** - Entspricht allen Unterpfaden unter /blog, einschließlich einzelner Blogbeiträge, Kategorieseiten usw.
Diese Kombination stellt sicher, dass wir alle blogbezogenen Inhalte erfassen, während andere Abschnitte der Website ausgeschlossen werden.

Beispielantwort

Blog-URLs nach Kategorie filtern

Du kannst deine Extraktion weiter verfeinern, um dich auf bestimmte Blogkategorien zu konzentrieren. Wenn du zum Beispiel nur an Stripes Engineering-Blogbeiträgen interessiert bist:

Nächste Schritte

Nachdem du nun alle Blog-URLs von Stripe extrahiert hast,
  1. kannst du deren Inhalte einzeln mit der Scrape-API abrufen.
  2. Oder, du verwendest den nächsten Leitfaden, um den tatsächlichen Inhalt dieser Blogseiten direkt mit eingebauten Filtern zu crawlen und zu extrahieren.