> ## Documentation Index
> Fetch the complete documentation index at: https://docs.olostep.com/llms.txt
> Use this file to discover all available pages before exploring further.

# Pagine del Crawl

> Recupera l’elenco delle pagine per un crawl specifico.



## OpenAPI

````yaml it/openapi/crawls.json GET /v1/crawls/{crawl_id}/pages
openapi: 3.0.3
info:
  title: API di Crawl
  version: 1.0.0
servers:
  - url: https://api.olostep.com
security: []
paths:
  /v1/crawls/{crawl_id}/pages:
    get:
      summary: Recupera l'elenco delle pagine scansionate opzionalmente con contenuto
      description: >-
        Recupera l'elenco delle pagine scansionate e del contenuto che sono
        stati elaborati per un ID di crawl specifico.
      parameters:
        - name: crawl_id
          in: path
          required: true
          schema:
            type: string
          description: L'ID del crawl per cui recuperare l'elenco degli URL.
        - name: cursor
          in: query
          required: false
          schema:
            type: integer
          description: >-
            Intero opzionale che rappresenta l'indice da cui iniziare a
            recuperare il contenuto. Utile per paginare fino a quando tutti gli
            URL sono stati recuperati. Inizia con 0, poi fornisci il valore
            `response['cursor']` dell'ultima richiesta.
        - name: limit
          in: query
          required: false
          schema:
            type: integer
          description: >-
            Intero opzionale per limitare il numero di risultati restituiti. Si
            consiglia di ottenere 10-50 risultati alla volta. Paginato usando
            *cursor*. Massimo 10MB di contenuto possono essere recuperati in una
            singola richiesta.
        - name: search_query
          in: query
          required: false
          schema:
            type: string
          description: >-
            Una query di ricerca opzionale per ordinare i risultati per
            rilevanza. Utilizza la search_query originale per impostazione
            predefinita se fornita.
        - name: formats
          in: query
          required: false
          schema:
            type: array
            items:
              type: string
              enum:
                - html
                - markdown
          description: >-
            **Deprecato:** Usa l'endpoint `/retrieve` con `retrieve_id`.  Array
            di formati da recuperare (ad esempio, ["html", "markdown"]).
      responses:
        '200':
          description: Risposta riuscita con l'elenco degli URL.
          content:
            application/json:
              schema:
                type: object
                properties:
                  crawl_id:
                    type: string
                    description: ID del Crawl
                  object:
                    type: string
                    description: Il tipo di oggetto. "crawl" per questo endpoint.
                  status:
                    type: string
                    description: '`in_progress` o `completed`'
                  search_query:
                    type: string
                  pages_count:
                    type: number
                  pages:
                    type: array
                    items:
                      type: object
                      properties:
                        id:
                          type: string
                        retrieve_id:
                          type: string
                          description: >-
                            Per recuperare il contenuto dall'endpoint
                            `/retrieve`
                        url:
                          type: string
                        is_external:
                          type: boolean
                        html_content:
                          type: string
                          description: >-
                            Deprecato: Usa l'endpoint `/retrieve` con
                            `retrieve_id`.
                        markdown_content:
                          type: string
                          description: >-
                            Deprecato: Usa l'endpoint `/retrieve` con
                            `retrieve_id`.
                  metadata:
                    type: object
                    properties:
                      external_urls:
                        type: array
                        description: URL esterni trovati durante la scansione
                        items:
                          type: string
                      failed_urls:
                        type: array
                        description: URL trovati ma che non è stato possibile estrarre
                        items:
                          type: string
                  cursor:
                    type: integer
                    description: >-
                      Da passare nella query nella prossima richiesta per
                      ottenere i prossimi elementi.
        '400':
          description: Richiesta errata a causa di parametri mancanti o errati.
        '404':
          description: Crawl non trovato per l'ID fornito.
        '500':
          description: Errore interno del server.
      security:
        - Authorization: []
components:
  securitySchemes:
    Authorization:
      type: http
      scheme: bearer
      description: >-
        Intestazione di autenticazione Bearer del tipo Bearer <token>, dove
        <token> è il tuo token di autenticazione.

````