> ## Documentation Index
> Fetch the complete documentation index at: https://docs.olostep.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Crawl Pagina’s

> Haalt de lijst van pagina’s op voor een specifieke crawl.



## OpenAPI

````yaml nl/openapi/crawls.json GET /v1/crawls/{crawl_id}/pages
openapi: 3.0.3
info:
  title: Crawl API
  version: 1.0.0
servers:
  - url: https://api.olostep.com
security: []
paths:
  /v1/crawls/{crawl_id}/pages:
    get:
      summary: Haal lijst van gecrawlde pagina's op, optioneel met inhoud
      description: >-
        Haalt de lijst van gecrawlde pagina's en inhoud op die zijn verwerkt
        voor een specifieke crawl ID.
      parameters:
        - name: crawl_id
          in: path
          required: true
          schema:
            type: string
          description: De ID van de crawl waarvoor je de lijst van URLs wilt ophalen.
        - name: cursor
          in: query
          required: false
          schema:
            type: integer
          description: >-
            Optioneel geheel getal dat de index vertegenwoordigt om inhoud vanaf
            te halen. Handig om te pagineren totdat alle URLs zijn opgehaald.
            Begin met 0, geef dan de waarde van `response['cursor']` van het
            laatste verzoek.
        - name: limit
          in: query
          required: false
          schema:
            type: integer
          description: >-
            Optioneel geheel getal om het aantal geretourneerde resultaten te
            beperken. Aanbevolen 10-50 resultaten per keer. Gepagineerd met
            behulp van *cursor*. Maximaal 10MB aan inhoud kan in één verzoek
            worden opgehaald.
        - name: search_query
          in: query
          required: false
          schema:
            type: string
          description: >-
            Een optionele zoekopdracht om de resultaten op relevantie te
            sorteren. Gebruikt standaard de originele search_query als deze is
            opgegeven.
        - name: formats
          in: query
          required: false
          schema:
            type: array
            items:
              type: string
              enum:
                - html
                - markdown
          description: >-
            **Verouderd:** Gebruik de `/retrieve` endpoint met `retrieve_id`. 
            Array van formaten om op te halen (bijv. ["html", "markdown"]).
      responses:
        '200':
          description: Succesvolle reactie met de lijst van URLs.
          content:
            application/json:
              schema:
                type: object
                properties:
                  crawl_id:
                    type: string
                    description: Crawl ID
                  object:
                    type: string
                    description: Het soort object. "crawl" voor deze endpoint.
                  status:
                    type: string
                    description: '`in_progress` of `completed`'
                  search_query:
                    type: string
                  pages_count:
                    type: number
                  pages:
                    type: array
                    items:
                      type: object
                      properties:
                        id:
                          type: string
                        retrieve_id:
                          type: string
                          description: Om inhoud op te halen van de `/retrieve` endpoint.
                        url:
                          type: string
                        is_external:
                          type: boolean
                        html_content:
                          type: string
                          description: >-
                            Verouderd: Gebruik de `/retrieve` endpoint met
                            `retrieve_id`.
                        markdown_content:
                          type: string
                          description: >-
                            Verouderd: Gebruik de `/retrieve` endpoint met
                            `retrieve_id`.
                  metadata:
                    type: object
                    properties:
                      external_urls:
                        type: array
                        description: Externe URLs die werden gevonden tijdens het crawlen
                        items:
                          type: string
                      failed_urls:
                        type: array
                        description: >-
                          URLs die werden gevonden maar niet konden worden
                          gescraped
                        items:
                          type: string
                  cursor:
                    type: integer
                    description: >-
                      Moet in de query worden doorgegeven in de volgende
                      aanvraag om de volgende items te krijgen.
        '400':
          description: Foutieve aanvraag door onjuiste of ontbrekende parameters.
        '404':
          description: Crawl niet gevonden voor de opgegeven ID.
        '500':
          description: Interne serverfout.
      security:
        - Authorization: []
components:
  securitySchemes:
    Authorization:
      type: http
      scheme: bearer
      description: >-
        Bearer authenticatie header in de vorm Bearer <token>, waar <token> jouw
        auth token is.

````