76% dos Sites com um arquivo llms.txt Erram na Configuração
Auditamos 142 sites entre maio e julho 2026. 56% não tinham llms.txt, e 48 dos 63 que publicaram um falharam na validade. Aqui estão os 3 erros que explicam quase todas as falhas.
Dos 142 sites que auditamos entre 4 de maio e 19 de julho de 2026, 79 não tinham arquivo llms.txt de todo. Dos 63 que publicaram um, 48 publicou um quebrado. Isso deixa 13 sites — 9% da amostra — com um arquivo válido.
A proposta llms.txt é simples: coloque um arquivo markdown na raiz do seu domínio que dê aos agentes de IA um mapa curado, em texto simples, do seu site. Quando alguém pergunta ChatGPT, Claude ou Perplexity uma pergunta que seu site poderia responder, um agente que busca seu llms.txt no momento da inferência obtém exatamente o contexto que você escolheu — em vez de uma raspagem de esforço máximo da sua página inicial HTML. A especificação é deliberadamente mínima: um H1 com o nome do seu site, um resumo em blockquote e listas markdown de links para seu conteúdo mais importante.
Um ano após a adoção, a lacuna não é mais de conscientização. É execução.
O conjunto de dados
| Sites com dados de auditoria por verificação | 142 |
| Sites sem arquivo llms.txt | 79 (55.6%) |
| Sites com arquivo presente | 63 (44.4%) |
| Arquivos que falharam na validade | 48 (76.2% dos presentes) |
| Arquivos válidos | 13 (20.6% dos presentes) |
Metodologia: última captura de auditoria concluída por domínio, extraída de verificações de produção entre maio 4 e July 19, 2026. Todos os domínios foram anonimizados. O exemplo é auto-selecionado — sites cujos proprietários realizaram uma auditoria — e tende a favorecer propriedades pequenas e de médio porte, portanto trate-o como indicativo em vez de um censo da web.
Os 3 erros por trás de quase todos os arquivos inválidos
Nosso motor valida um llms.txt contra a estrutura da especificação, e a evidência de falha é notavelmente consistente. Os problemas 3 explicam quase tudo — a maioria dos arquivos quebrados tem 2 ou 3 deles de uma vez:
- Nenhum link de referência (40 de 48 arquivos inválidos). O arquivo existe, mas não contém links em markdown. Este é o objetivo completo do formato — uma lista curada de URLs que um agente deve ler. Um arquivo sem links é um cartaz sem mapa.
- Faltando o bloco de citação resumida (38 de 48). A especificação exige um bloco de citação
> Summarylogo após o título que diz ao agente o que o site é e como interpretar os links. Sem ele, um agente recebe uma lista de URLs sem estrutura para escolher entre elas. - Faltando o título H1 (33 de 48). A única seção que a especificação marca como estritamente necessária. Arquivos que começam com prosa, um comentário ou um H2 não dão nada ao analisador para ancorar.
O padrão abaixo de todos os 3 é o mesmo: equipes geram um espaço reservado — às vezes literalmente a palavra "llms.txt" repetida, ou um parágrafo de cópia de marketing — e o implementam como uma caixa de seleção. Um agente lendo tal arquivo não aprende nada e segue em frente. A busca foi desperdiçada.
Quando os próprios links estão mortos
A validade é estrutura. A próxima verificação é se os URLs referenciados realmente resolvem. A maioria dos sites com estrutura válida também passa nisso, mas as falhas são instrutivas: 7 sites listaram links que retornaram erros, com uma mediana de 19 referências mortas por site. Um site de comércio eletrônico listou 3,042 URLs de produto em seu llms.txt que não resolviam mais — o arquivo havia sido claramente gerado uma vez a partir de um feed de produto e nunca regenerado.
Essa anedota é um exemplo de 7, então trate-a como um aviso em vez de uma estatística. Mas o mecanismo vale a pena lembrar: um llms.txt é um documento vivo. Se o seu catálogo, documentos ou páginas de preços mudarem, o arquivo apodrece — e um agente seguindo links mortos pode concluir que seu conteúdo desapareceu, não foi movido.
Como fica um arquivo válido
O próprio exemplo da especificação é o melhor modelo. Um mínimo, válido llms.txt precisa de um H1, um bloco de citação resumido e pelo menos uma lista de links anotados:
# Acme Analytics> Acme Analytics is a reporting API for ecommerce teams. This file lists our most useful resources for AI agents.## Docs- [API quickstart](https://acme.example/docs/quickstart): Authentication and first request in 5 minutes- [Metrics reference](https://acme.example/docs/metrics): Every metric, its definition, and its SQL## Product- [Pricing](https://acme.example/pricing): Plans and usage limits- [Changelog](https://acme.example/changelog): Release notes since 2024## Optional- [Full documentation index](https://acme.example/docs): Everything else, for larger context windows
A seção Optional tem um significado definido: agentes com pouco contexto podem ignorá‑la. Coloque seu melhor material acima disso.
Por que isso vale 30 minutos
Sitemaps informam os motores de busca o que existe. robots.txt indica aos rastreadores o que é permitido. llms.txt é o único arquivo que diz a um agente de IA o que importa — escrito no formato que ele lê nativamente, no momento em que decide se seu site ajuda a responder a uma pergunta do usuário. É também um dos poucos alavancas de busca por IA que você controla totalmente: sem provedor de modelo, sem algoritmo de classificação, sem esperar por um rastreamento.
A sequência de correção é curta. Escreva o arquivo a partir do modelo acima — 10 minutos. Link apenas para páginas que resolvem, e prefira URLs estáveis. Regenerar ou revisar sempre que sua arquitetura de informação mudar. Em seguida, verifique da forma que um agente faria: buscar, analisar e seguir os links.
Cada auditoria que realizamos verifica todas as camadas 3 — presença, validade e se as referências resolvem — como parte da família de prontidão em IA. Se quiser saber em qual dos 3 grupos seu site se enquadra, você pode executar seu próprio relatório e encontrar as verificações llms.txt na seção de prontidão em IA.
A conclusão
A adoção é a primeira lacuna: 56% dos sites auditados não têm arquivo. Mas a descoberta mais aguda é que publicar um arquivo não é a linha de chegada — 3 em 4 dos sites que publicaram um, um agente não pode usar. Os sites na minoria válida não fizeram nada exótico. Eles escreveram um H1, um resumo de 2 frases, e uma lista de links que funcionam. Isso é toda a barra — e 91% da amostra está abaixo dela.
Veja como seu site está classificado
Get a free IA-powered SEO report with actionable findings and priority fixes for your website.
Não é necessário cadastro.