76% de Sitios con un archivo llms.txt que lo hacen mal
Auditémos 142 sitios entre mayo y julio 2026. 56% no tenían llms.txt en absoluto, y 48 de los 63 que publicaron uno fallaron en validez. Aquí están los 3 errores que explican casi todas las fallas.
De los 142 sitios que auditamos entre el 4 de mayo y el 19 de julio de 2026, 79 no tenían archivo llms.txt en absoluto. De los 63 que publicaron uno, 48 publicó uno roto. Eso deja 13 sitios — 9% de la muestra — con un archivo válido.
La propuesta llms.txt es simple: coloca un archivo markdown en la raíz de tu dominio que proporcione a los agentes de IA un mapa curado y de texto plano de tu sitio. Cuando alguien pregunta ChatGPT, Claude o Perplexity una pregunta que tu sitio podría responder, un agente que recupera tu llms.txt en tiempo de inferencia obtiene exactamente el contexto que elegiste — en lugar de un raspado de esfuerzo máximo de tu página de inicio HTML. La especificación es deliberadamente mínima: un H1 con el nombre de tu sitio, un resumen en blockquote y listas markdown de enlaces a tu contenido más importante.
Un año después de la adopción, la brecha ya no es conciencia. Es ejecución.
El conjunto de datos
| Sitios con datos de auditoría por verificación | 142 |
| Sitios sin archivo llms.txt | 79 (55.6%) |
| Sitios con un archivo presente | 63 (44.4%) |
| Archivos que fallaron en validez | 48 (76.2% de presentes) |
| Archivos válidos | 13 (20.6% de presentes) |
Metodología: instantánea de auditoría completada más reciente por dominio, extraída de verificaciones de producción entre mayo 4 y July 19, 2026. Todos los dominios están anonimizados. La muestra es auto-seleccionada — sitios cuyos propietarios realizaron una auditoría — y se inclina hacia propiedades pequeñas y medianas, por lo que debe considerarse orientativa en lugar de un censo de la web.
Los 3 errores detrás de casi cada archivo inválido
Nuestro motor valida un llms.txt contra la estructura de la especificación, y la evidencia de fallo es notablemente consistente. Los problemas de 3 explican casi todo — la mayoría de los archivos rotos tienen 2 o 3 de ellos a la vez:
- Sin enlaces de referencia (40 de 48 archivos inválidos). El archivo existe, pero no contiene enlaces markdown. Este es el objetivo completo del formato — una lista curada de URLs que un agente debe leer. Un archivo sin enlaces es un póster sin mapa.
- Falta el bloque de cita del resumen (38 de 48). La especificación exige un bloque de cita
> Summaryjusto después del título que indica a un agente qué es el sitio y cómo interpretar los enlaces. Sin él, un agente recibe una lista de URLs sin marco para elegir entre ellas. - Falta el título H1 (33 de 48). La única sección que la especificación marca como estrictamente requerida. Los archivos que abren con prosa, un comentario o un H2 no dan a los analizadores nada con lo que anclar.
El patrón bajo todos los 3 es el mismo: los equipos generan un marcador de posición — a veces literalmente la palabra "llms.txt" repetida, o un párrafo de texto publicitario — y lo despliegan como una casilla de verificación. Un agente que lee tal archivo no aprende nada y sigue adelante. La búsqueda fue desperdiciada.
Cuando los propios enlaces están muertos
La validez es la estructura. La siguiente verificación es si las URLs referenciadas realmente se resuelven. La mayoría de los sitios con estructura válida también pasan esto, pero los fracasos son instructivos: 7 sitios listaron enlaces que devolvieron errores, con una mediana de 19 referencias muertas por sitio. Una propiedad de comercio electrónico listó 3,042 URLs de productos en su llms.txt que ya no se resolvieron — el archivo claramente se generó una vez a partir de un feed de productos y nunca se regeneró.
Ese anécdota es una muestra de 7, así que considérala una advertencia más que una estadística. Pero el mecanismo vale la pena recordar: un llms.txt es un documento vivo. Si tu catálogo, documentación o páginas de precios se mueven, el archivo se pudre — y un agente que sigue enlaces muertos puede concluir que tu contenido se ha ido, no que se ha movido.
Cómo se ve un archivo válido
El propio ejemplo de la especificación es la mejor plantilla. Un llms.txt mínimo y válido necesita un H1, un bloque de resumen con cita y al menos una lista de enlaces anotados:
# Acme Analytics> Acme Analytics is a reporting API for ecommerce teams. This file lists our most useful resources for AI agents.## Docs- [API quickstart](https://acme.example/docs/quickstart): Authentication and first request in 5 minutes- [Metrics reference](https://acme.example/docs/metrics): Every metric, its definition, and its SQL## Product- [Pricing](https://acme.example/pricing): Plans and usage limits- [Changelog](https://acme.example/changelog): Release notes since 2024## Optional- [Full documentation index](https://acme.example/docs): Everything else, for larger context windows
La sección Optional tiene un significado definido: los agentes con poco contexto pueden omitirla. Pon tu mejor material encima de ella.
Por qué esto vale 30 minutos
Los sitemaps indican a los motores de búsqueda lo que existe. robots.txt indica a los rastreadores lo que está permitido. llms.txt es el único archivo que indica a un agente IA lo que importa — escrito en el formato que lee nativamente, en el momento en que decide si tu sitio ayuda a responder una pregunta del usuario. También es uno de los pocos palancas de búsqueda IA que controlas completamente: sin proveedor de modelo, sin algoritmo de ranking, sin esperar un rastreo.
La secuencia de corrección es corta. Escribe el archivo a partir de la plantilla anterior — 10 minutos. Enlaza solo a páginas que resuelvan, y prefiere URLs estables. Regenera o revísalo siempre que cambie tu arquitectura de información. Entonces verifica como lo haría un agente: lo obtienes, lo analizas, sigues los enlaces.
Cada auditoría que realizamos revisa todas las capas 3 — presencia, validez y si las referencias se resuelven — como parte de la familia de preparación de IA. Si quieres saber a cuál de los 3 grupos pertenece tu sitio, puedes ejecutar tu propio informe y encontrar las comprobaciones llms.txt en la sección de preparación de IA.
El punto principal
La adopción es la primera brecha: 56% de los sitios auditados no tienen archivo. Pero el hallazgo más agudo es que publicar un archivo no es la meta final — 3 en 4 de los sitios que se molestaron en publicar uno un agente no puede usar. Los sitios en la minoría válida no hicieron nada exótico. Escribieron un H1, un resumen de 2-sentencias, y una lista de enlaces que funcionan. Eso es toda la barra — y 91% de la muestra está bajo ella.
Ver cómo se clasifica tu sitio
Get a free IA-powered SEO report with actionable findings and priority fixes for your website.
Sin registro obligatorio.