> ## Documentation Index
> Fetch the complete documentation index at: https://docs.olostep.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Crawl-Seiten

> Ruft die Liste der Seiten für einen bestimmten Crawl ab.



## OpenAPI

````yaml de/openapi/crawls.json GET /v1/crawls/{crawl_id}/pages
openapi: 3.0.3
info:
  title: Crawl-API
  version: 1.0.0
servers:
  - url: https://api.olostep.com
security: []
paths:
  /v1/crawls/{crawl_id}/pages:
    get:
      summary: Liste der gecrawlten Seiten optional mit Inhalt abrufen
      description: >-
        Ruft die Liste der gecrawlten Seiten und Inhalte ab, die für eine
        bestimmte Crawl-ID verarbeitet wurden.
      parameters:
        - name: crawl_id
          in: path
          required: true
          schema:
            type: string
          description: Die ID des Crawls, für den die Liste der URLs abgerufen werden soll.
        - name: cursor
          in: query
          required: false
          schema:
            type: integer
          description: >-
            Optionaler Integer, der den Index darstellt, ab dem Inhalte
            abgerufen werden sollen. Nützlich, um zu paginieren, bis alle URLs
            abgerufen sind. Beginne mit 0 und gib dann den
            `response['cursor']`-Wert der letzten Anfrage an.
        - name: limit
          in: query
          required: false
          schema:
            type: integer
          description: >-
            Optionaler Integer, um die Anzahl der zurückgegebenen Ergebnisse zu
            begrenzen. Empfohlen 10-50 Ergebnisse auf einmal. Paginierung mit
            *cursor*. Maximal 10MB Inhalt können in einer einzigen Anfrage
            abgerufen werden.
        - name: search_query
          in: query
          required: false
          schema:
            type: string
          description: >-
            Eine optionale Suchanfrage, um die Ergebnisse nach Relevanz zu
            sortieren. Verwendet standardmäßig die ursprüngliche search_query,
            falls angegeben.
        - name: formats
          in: query
          required: false
          schema:
            type: array
            items:
              type: string
              enum:
                - html
                - markdown
          description: >-
            **Veraltet:** Verwende den `/retrieve` Endpunkt mit `retrieve_id`. 
            Array von Formaten zum Abrufen (z.B. ["html", "markdown"]).
      responses:
        '200':
          description: Erfolgreiche Antwort mit der Liste der URLs.
          content:
            application/json:
              schema:
                type: object
                properties:
                  crawl_id:
                    type: string
                    description: Crawl-ID
                  object:
                    type: string
                    description: Die Art des Objekts. "crawl" für diesen Endpunkt.
                  status:
                    type: string
                    description: '`in_progress` oder `completed`'
                  search_query:
                    type: string
                  pages_count:
                    type: number
                  pages:
                    type: array
                    items:
                      type: object
                      properties:
                        id:
                          type: string
                        retrieve_id:
                          type: string
                          description: Um Inhalte vom `/retrieve` Endpunkt abzurufen.
                        url:
                          type: string
                        is_external:
                          type: boolean
                        html_content:
                          type: string
                          description: >-
                            Veraltet: Verwende den `/retrieve` Endpunkt mit
                            `retrieve_id`.
                        markdown_content:
                          type: string
                          description: >-
                            Veraltet: Verwende den `/retrieve` Endpunkt mit
                            `retrieve_id`.
                  metadata:
                    type: object
                    properties:
                      external_urls:
                        type: array
                        description: Externe URLs, die während des Crawls gefunden wurden
                        items:
                          type: string
                      failed_urls:
                        type: array
                        description: >-
                          URLs, die gefunden wurden, aber nicht abgerufen werden
                          konnten
                        items:
                          type: string
                  cursor:
                    type: integer
                    description: >-
                      Muss in der nächsten Anfrage in der Abfrage übergeben
                      werden, um die nächsten Elemente zu erhalten.
        '400':
          description: Ungültige Anfrage aufgrund falscher oder fehlender Parameter.
        '404':
          description: Crawl für die angegebene ID nicht gefunden.
        '500':
          description: Interner Serverfehler.
      security:
        - Authorization: []
components:
  securitySchemes:
    Authorization:
      type: http
      scheme: bearer
      description: >-
        Bearer-Authentifizierungsheader in der Form Bearer <token>, wobei
        <token> dein Authentifizierungstoken ist.

````