Explorar la documentación
Agents & crawlers

Agentes y rastreadores de IA

Qué publica BoostEcom para rastreadores y agentes LLM, qué bots están permitidos, y cómo leer esta documentación mediante programa.

Este sitio está construido para ser leído por agentes, no solo tolerado por ellos.

Los índices

| Superficie | Formato | Para | |---|---|---| | /llms.txt | Markdown | Un índice editorial curado para rastreadores LLM. | | /llms.json | JSON | La variante estructurada, para agentes modernos. | | /sitemap.xml | XML | Derivado: contenido MDX, marketplace, agentes. | | /robots.txt | texto | La lista blanca de rastreadores. |

/llms.txt está curado a mano, no generado a partir del sitemap. Ese es el punto: un rastreador que lo sigue aterriza en las páginas que vale la pena leer en lugar de en cada URL que resulta existir.

Rastreadores permitidos

robots.txt permite explícitamente, entre otros:

  • GPTBot
  • ClaudeBot
  • anthropic-ai
  • PerplexityBot
  • Google-Extended

Es una lista blanca deliberada, no un descuido. Queremos estos documentos en los motores de respuesta.

Datos estructurados

Las páginas llevan JSON-LD apropiado a su tipo: WebPage y Article en todas partes, FAQPage donde hay una FAQ, HowTo en los tutoriales y las guías de conexión por cliente, Product con AggregateRating y Offer en los listados de marketplace, Event en los eventos de comunidad.

Las migas de pan se emiten como BreadcrumbList en cada página de documentación.

Lo que deliberadamente no es rastreable

Tres superficies son noindex y están fuera del sitemap a propósito:

  • Los registros de Intelligence en /intelligence/stores/<dominio>, porque describen tiendas de terceros.
  • Las entregas de Creative Drop en /drop/<token>, públicas por token, con un Disallow en robots.txt además del noindex. El token es el control de acceso.
  • Los embeds en /embed/bulletin y /embed/widget, las dos únicas rutas donde se levanta la prohibición global de frame del sitio.

Leer estos documentos como agente

Cada página bajo /docs/ es un único documento MDX renderizado en servidor, sin hidratación en cliente necesaria para leer el contenido. Obtener la URL te da el texto completo.

Los dos troncos —producto y desarrollador— se derivan del front-matter, así que el hub en /docs es un índice completo de lo que existe. No hay sección oculta.

Nuestro propio perfil de agente

Cuando BoostEcom actúa como cliente frente a una tienda Shopify, publica sus capacidades en /.well-known/ucp-agent. Cada tienda que consultamos lo lee para negociar antes de responder. Declara acceso de lectura al catálogo y no contiene secretos.

¿Has construido con estas docs?

Pásate por el foro si algo no está claro o es incorrecto. La documentación mejora más rápido cuando los lectores señalan los huecos.

Abrir el foro