Back to articles

de Sites com um arquivo llms.txt Erram

SEOReport Team·
llms-txtai-seoai-searchai-readinesstechnical-seodata-analysis

We audited 142 websites between May and July 2026. 56% had no llms.txt at all, and 48 of the 63 that published one failed validity. Here are the 3 mistakes that account for nearly every failure.

Dos 142 sites auditados entre 4 de maio e 19 de julho de 2026, 79 não tinham arquivo llms.txt de jeito nenhum. Dos que publicaram um, publicaram um quebrado. Isso deixa sites — da amostra — com um arquivo válido. A proposta llms.txt é simples: coloque um arquivo markdown na raiz do seu domínio que dê aos agentes de IA um mapa curado, em texto simples, do seu site. Quando alguém pergunta ChatGPT, Claude ou Perplexity uma pergunta que seu site poderia responder, um agente que busca seu llms.txt no momento da inferência obtém exatamente o contexto que você escolheu — em vez de uma raspagem de tentativa máxima da sua página inicial HTML. A especificação é deliberadamente mínima: um H1 com o nome do seu site, um resumo em blockquote e listas markdown de links para seu conteúdo mais importante. Um ano após a adoção, a lacuna não é mais consciência. É execução.

O conjunto de dados

MétricaValor
Sites com dados de auditoria por verificação
Sites sem arquivo llms.txt()
Sites com arquivo presente()
Arquivos que falharam na validade( dos presentes)
Arquivos válidos( dos presentes)

Metodologia: última captura de auditoria concluída por domínio, extraída de verificações de produção entre maio e . Todos os domínios anonimados. A amostra é auto-selecionada — sites cujos proprietários realizaram uma auditoria — e tende a favorecer propriedades pequenas e de médio porte, portanto trate-a como orientativa em vez de um censo da web.

llms.txt Outcomes Across 142 Audited Websites

Os erros por trás de quase todos os arquivos inválidos

Nosso motor valida um llms.txt contra a estrutura da especificação, e a evidência de falha é notavelmente consistente. problemas explicam quase tudo — a maioria dos arquivos quebrados tem ou deles de uma vez:

. Nenhum link de referência ( de arquivos inválidos). O arquivo existe, mas não contém links em markdown. Este é o objetivo completo do formato — uma lista curada de URLs que um agente deve ler. Um arquivo sem links é um pôster sem mapa. 2. Faltando o bloco de citação resumida (38 de 48). A especificação exige um bloco de citação > Summary logo após o título que diz ao agente o que o site é e como interpretar os links. Sem ele, um agente recebe uma lista de URLs sem estrutura para escolher entre elas. . Faltando o título H ( de ). A única seção que a especificação marca como estritamente necessária. Arquivos que começam com prosa, um comentário ou um H não dão nada para os analisadores se ancorarem.

O padrão abaixo de todos os é o mesmo: equipes geram um espaço reservado — às vezes literalmente a palavra "llms.txt" repetida, ou um parágrafo de cópia de marketing — e o implementam como uma caixa de seleção. Um agente lendo tal arquivo não aprende nada e segue em frente. A busca foi desperdiçada.

Quando os próprios links estão mortos

Validade é estrutura. A próxima verificação é se os URLs referenciados realmente resolvem. A maioria dos sites com estrutura válida também passa por isso, mas as falhas são instrutivas: sites listaram links que retornaram erros, com uma mediana de referências mortas por site. Um site de comércio eletrônico listou 3.042 URLs de produto em seu llms.txt que não resolviam mais — o arquivo claramente havia sido gerado uma vez a partir de um feed de produto e nunca regenerado. Essa anedota é uma amostra de , portanto trate-a como um aviso em vez de uma estatística. Mas o mecanismo vale a pena lembrar: um llms.txt é um documento vivo. Se o seu catálogo, documentos ou páginas de preços mudarem, o arquivo apodrece — e um agente seguindo links mortos pode concluir que seu conteúdo desapareceu, não foi movido.

Como fica um arquivo válido

O próprio exemplo da especificação é o melhor modelo. Um llms.txt mínimo e válido precisa de um H1, um bloco de citação resumida e pelo menos uma lista de links anotados:

markdown
# Acme Analytics
> Acme Analytics is a reporting API for ecommerce teams. This file lists our most useful resources for AI agents.
## Docs
- [API quickstart](https://acme.example/docs/quickstart): Authentication and first request in 5 minutes
- [Metrics reference](https://acme.example/docs/metrics): Every metric, its definition, and its SQL
## Product
- [Pricing](https://acme.example/pricing): Plans and usage limits
- [Changelog](https://acme.example/changelog): Release notes since 2024
## Optional
- [Full documentation index](https://acme.example/docs): Everything else, for larger context windows

A seção Optional tem um significado definido: agentes com pouco contexto podem ignorá‑la. Coloque seu melhor material acima disso.

graph TD A[Agente busca /llms.txt] --> B{Arquivo presente?} B -->|ou erro| C[Agente recorre à raspagem de HTML] B -->|| D{Estrutura válida?} D -->|Nenhum H, resumo ou links| E[Busca desperdiçada — sem contexto utilizável] D -->|Válido| F{Referências resolvidas?} F -->|Links quebrados| G[Agente conclui que o conteúdo desapareceu] F -->|Links ativos| H[Agente lê suas páginas curadas]

Por que isso vale minutos

Sitemaps informam aos motores de busca o que existe. robots.txt indica aos rastreadores o que é permitido. llms.txt é o único arquivo que diz a um agente de IA o que importa — escrito no formato que ele lê nativamente, no momento em que decide se seu site ajuda a responder a uma pergunta do usuário. É também um dos poucos alavancas de busca por IA que você controla totalmente: sem provedor de modelo, sem algoritmo de ranking, sem esperar por um rastreamento. A sequência de correção é curta. Escreva o arquivo a partir do modelo acima — minutos. Vincule apenas a páginas que resolvem, e prefira URLs estáveis. Regene ou revise sempre que sua arquitetura de informação mudar. Em seguida, verifique da forma que um agente faria: busque-o, analise-o, siga os links. Cada auditoria que executamos verifica todas as camadas — presença, validade e se as referências resolvem — como parte da família de prontidão da IA. Se você quiser saber a qual dos 3 grupos seu site pertence, pode executar seu próprio relatório e encontrar as verificações llms.txt na seção de prontidão da IA.

A linha de baixo

Adoção é a primeira lacuna: dos sites auditados não têm arquivo. Mas a descoberta mais aguda é que publicar um arquivo não é a linha de chegada — em dos sites que publicaram um, um agente não pode usar. Os sites na minoria válida não fizeram nada exótico. Eles escreveram um H, um resumo de frases, e uma lista de links que funcionam. Isso é a barra inteira — e da amostra está abaixo dela.

See How Your Site Ranks

Get a free AI-powered SEO report with actionable findings and priority fixes for your website.

No signup required.