Parcourir la documentation
Agents & crawlers

Agents & crawlers IA

Ce que BoostEcom publie pour les crawlers et agents LLM, quels bots sont autorisés, et comment lire cette documentation par programme.

Ce site est construit pour être lu par des agents, pas seulement toléré par eux.

Les index

| Surface | Format | Pour | |---|---|---| | /llms.txt | Markdown | Un index éditorial curé pour les crawlers LLM. | | /llms.json | JSON | La variante structurée, pour les agents modernes. | | /sitemap.xml | XML | Dérivé : contenu MDX, marketplace, agents. | | /robots.txt | texte | La liste blanche des crawlers. |

/llms.txt est curé à la main, pas généré depuis le sitemap. C'est tout l'intérêt : un crawler qui le suit atterrit sur les pages qui valent la peine d'être lues plutôt que sur chaque URL qui existe.

Crawlers autorisés

robots.txt autorise explicitement, entre autres :

  • GPTBot
  • ClaudeBot
  • anthropic-ai
  • PerplexityBot
  • Google-Extended

C'est une liste blanche délibérée, pas un oubli. Nous voulons ces docs dans les moteurs de réponse.

Données structurées

Les pages portent du JSON-LD adapté à leur type : WebPage et Article partout, FAQPage là où il y a une FAQ, HowTo sur les tutoriels et les guides de connexion par client, Product avec AggregateRating et Offer sur les fiches marketplace, Event sur les événements communautaires.

Le fil d'Ariane est émis en BreadcrumbList sur chaque page de documentation.

Ce qui n'est délibérément pas crawlable

Trois surfaces sont noindex et hors sitemap volontairement :

  • Les enregistrements Intelligence sur /intelligence/stores/<domaine>, parce qu'ils décrivent des boutiques tierces.
  • Les livraisons Creative Drop sur /drop/<token>, publiques par jeton, avec un Disallow dans robots.txt en plus du noindex. Le jeton est le contrôle d'accès.
  • Les embeds sur /embed/bulletin et /embed/widget, les deux seuls chemins où l'interdiction globale de frame du site est levée.

Lire ces docs en tant qu'agent

Chaque page sous /docs/ est un document MDX unique rendu côté serveur, sans hydratation côté client nécessaire pour lire le contenu. Récupérer l'URL vous donne le texte complet.

Les deux troncs — produit et développeur — sont dérivés du front-matter, donc le hub sur /docs est un index complet de ce qui existe. Il n'y a pas de section cachée.

Notre propre profil d'agent

Quand BoostEcom agit en tant que client face à une boutique Shopify, il publie ses capacités sur /.well-known/ucp-agent. Chaque boutique que nous interrogeons le lit pour négocier avant de répondre. Il déclare un accès en lecture au catalogue et ne contient aucun secret.

Vous avez construit avec cette doc ?

Passez sur le forum si quelque chose n'est pas clair ou est faux. La doc s'améliore plus vite quand les lecteurs signalent les manques.

Ouvrir le forum