Sfoglia la documentazione
Agents & crawlers

Agenti e crawler IA

Cosa pubblica BoostEcom per crawler e agenti LLM, quali bot sono autorizzati, e come leggere questa documentazione a livello programmatico.

Questo sito è costruito per essere letto dagli agenti, non solo tollerato da essi.

Gli indici

| Superficie | Formato | Per | |---|---|---| | /llms.txt | Markdown | Un indice editoriale curato per crawler LLM. | | /llms.json | JSON | La variante strutturata, per agenti moderni. | | /sitemap.xml | XML | Derivato — contenuto MDX, marketplace, agenti. | | /robots.txt | testo | La lista bianca dei crawler. |

/llms.txt è curato a mano, non generato dalla sitemap. Questo è il punto: un crawler che lo segue atterra sulle pagine che vale la pena leggere invece che su ogni URL che esiste per caso.

Crawler autorizzati

robots.txt autorizza esplicitamente, tra gli altri:

  • GPTBot
  • ClaudeBot
  • anthropic-ai
  • PerplexityBot
  • Google-Extended

È una lista bianca deliberata, non una svista. Vogliamo questi documenti nei motori di risposta.

Dati strutturati

Le pagine portano JSON-LD appropriato al loro tipo: WebPage e Article ovunque, FAQPage dove c'è una FAQ, HowTo sui tutorial e sulle guide di connessione per client, Product con AggregateRating e Offer sulle inserzioni marketplace, Event sugli eventi di community.

I breadcrumb sono emessi come BreadcrumbList su ogni pagina di documentazione.

Cosa deliberatamente non è scansionabile

Tre superfici sono noindex e fuori dalla sitemap di proposito:

  • I record Intelligence su /intelligence/stores/<dominio>, perché descrivono store di terze parti.
  • Le consegne Creative Drop su /drop/<token>, pubbliche tramite token, con un Disallow in robots.txt in aggiunta al noindex. Il token è il controllo di accesso.
  • Gli embed su /embed/bulletin e /embed/widget, gli unici due percorsi dove viene revocato il divieto globale di frame del sito.

Leggere questi documenti come agente

Ogni pagina sotto /docs/ è un unico documento MDX renderizzato lato server, senza idratazione lato client necessaria per leggere il contenuto. Recuperare l'URL ti dà il testo completo.

I due tronchi (prodotto e sviluppatore) sono derivati dal front-matter, quindi l'hub su /docs è un indice completo di ciò che esiste. Non c'è alcuna sezione nascosta.

Il nostro profilo agente

Quando BoostEcom agisce come client verso uno store Shopify, pubblica le proprie capacità su /.well-known/ucp-agent. Ogni store che interroghiamo lo legge per negoziare prima di rispondere. Dichiara accesso in lettura al catalogo e non contiene segreti.

Hai costruito con queste docs?

Passa dal forum se qualcosa non è chiaro o è sbagliato. La documentazione migliora più in fretta quando chi legge segnala le lacune.

Apri il forum