76% の llms.txt ファイルを持つサイトが間違っている
私たちは 142 のウェブサイトを5月から7月 2026 の間に監査しました。 56% は llms.txt を全く持っておらず、 48 は llms.txt を公開した 63 のうち有効性に失敗しました。以下はほぼすべての失敗を説明する 3 のミスです.
2026年5月4日から7月19日までに監査した142のウェブサイトのうち、79は llms.txt ファイルを全く持っていませんでした。 llms.txt を公開した 63 のうち、 48 は壊れたものを公開しました. これにより 13 のサイトが残り、サンプルの 9% が有効なファイルを持っています.
llms.txt 提案はシンプルです:ドメインルートにマークダウンファイルを置き、AI エージェントにサイトのキュレーション済みのプレーンテキストマップを提供します。 誰かが ChatGPT、Claude、または Perplexity にあなたのサイトが答えられる質問をすると、推論時にあなたの llms.txt を取得するエージェントは、選択したコンテキストを正確に取得します ― あなたのホームページ HTML のベストエフォートスクレイプではなく。 specification は意図的に最小限です:サイト名の H1、ブロッククオートの要約、および最も重要なコンテンツへのリンクのマークダウンリスト。
受容のギャップはもう存在しません. 実行です.
データセット
| チェックごとの監査データを持つウェブサイト | 142 |
| llms.txt ファイルを持たないサイト | 79 (55.6%) |
| ファイルが存在するサイト | 63 (44.4%) |
| 有効性に失敗したファイル | 48 (76.2% of present) |
| 有効なファイル | 13 (20.6% of present) |
Methodology: 最新完了監査スナップショットは、ドメインごとに、5月4からJuly 19, 2026までの本番チェックから取得されます。 すべてのドメインは匿名化されています。 サンプルは自己選択で、監査を実施したサイトの所有者が対象であり、主に小規模および中規模のプロパティに偏っています。したがって、これはウェブ全体の統計ではなく、方向性のあるものとして扱ってください。
ほぼすべての無効ファイルの背後にある 3 の誤り
私たちのエンジンは llms.txt を仕様の構造に対して検証し、失敗の証拠は驚くほど一貫しています。 3 の問題はほぼすべてを占めます — ほとんどの壊れたファイルは同時に 2 または 3 を持っています:
1。 参照リンクがありません (40 の 48 無効ファイル)。 ファイルは存在しますが、マークダウンリンクは含まれていません. これはフォーマットの全てのポイントです — エージェントが読むべき URL のキュレーションリスト. リンクのないファイルは、地図のないポスターです.
2. 要約ブロック引用が欠落しています(48 のうち 38)。 仕様では、タイトルの直後に > Summary ブロック引用が必要で、サイトが何であるか、リンクをどのように解釈するかをエージェントに伝えます。 それがないと、エージェントは選択の枠もなく URL のリストを受け取ります.
3。 H1 タイトルが欠落しています(33 の 48)。 仕様で厳密に必須とマークされている唯一のセクションです. プロズ、コメント、または H2 で始まるファイルは、パーサーにアンカーを提供しません.
すべての 3 の下にあるパターンは同じです:チームはプレースホルダーを生成します — 文字通り「llms.txt」という単語を繰り返したり、マーケティングコピーの段落を作成したりし、チェックボックスとして展開します. そのようなファイルを読むエージェントは何も学ばず、次に進みます. 取得は無駄になりました.
リンク自体が無効な場合
有効性は構造です. 次のチェックは、参照された URL が実際に解決されるかどうかです. 構造が有効なほとんどのサイトもこれを通過しますが、失敗は教訓的です: 7 サイトはエラーを返したリンクをリストし、サイトあたり平均 19 の無効参照を持っていました. 1 つの e コマースプロパティは、llms.txt に 3,042 の製品 URL をリストしましたが、もはや解決できませんでした — ファイルは明らかに製品フィードから一度生成され、再生成されていませんでした。
その逸話は 7 のサンプルですので、統計ではなく警告として扱ってください. しかし、そのメカニズムは覚えておく価値があります: llms.txt は生きた文書です。 カタログ、ドキュメント、または価格ページが移動すると、ファイルは腐敗します — 死んだリンクをたどるエージェントは、コンテンツが消えたと結論付けるかもしれません.
有効なファイルの見た目
仕様自体の例が最高のテンプレートです. 最小で有効な llms.txt には H1、要約ブロッククオート、そして少なくとも一つの注釈付きリンクリストが必要です
# Acme Analytics> Acme Analytics is a reporting API for ecommerce teams. This file lists our most useful resources for AI agents.## Docs- [API quickstart](https://acme.example/docs/quickstart): Authentication and first request in 5 minutes- [Metrics reference](https://acme.example/docs/metrics): Every metric, its definition, and its SQL## Product- [Pricing](https://acme.example/pricing): Plans and usage limits- [Changelog](https://acme.example/changelog): Release notes since 2024## Optional- [Full documentation index](https://acme.example/docs): Everything else, for larger context windows
Optional セクションには定義された意味があります:文脈が不足しているエージェントはそれをスキップすることがあります 最高の素材をそれの上に置いてください.
これが価値がある理由は 30 分です
サイトマップは検索エンジンに存在するものを伝えます. robots.txt はクローラーに許可されているものを伝えます。 llms.txt は AI エージェントに「何が重要か」を伝える唯一のファイルです — それがネイティブに読み取る形式で書かれており、あなたのサイトがユーザーの質問に答えるのに役立つかどうかを判断する瞬間に。 それはまた、完全に制御できる数少ない AI 検索レバーの一つです:モデルプロバイダーも、ランキングアルゴリズムも、クローリングを待つ必要もありません.
修正シーケンスは短いです. 上記のテンプレートからファイルを書き出してください — 10 分. 解決するページにのみリンクし、安定した URL を優先してください. 情報アーキテクチャが変更されたら、再生成またはレビューしてください. その後、エージェントが行うように、取得、解析、リンクの追跡を行って確認してください.
実施する監査は、すべての3レイヤー(存在、妥当性、参照が解決されるかどうか)をチェックし、AIレディネスファミリーの一部として扱います. サイトがどの3つのグループに属するか知りたい場合は、自分でレポートを実行し、AIレディネスセクションのllms.txtチェックを確認してください。
結論として
まず採用が最初のギャップです:監査対象サイトの56%はファイルを持っていません. しかし、より鋭い発見は、ファイルを公開することがゴールではないということです — 3は、4のサイトのうち、公開したものをエージェントが使用できないものです. 有効な少数派のサイトは、エキゾチックなことは何もしませんでした. 彼らはH1を書き、2文の要約と機能するリンクのリストを作成しました. それが全体のバーであり、サンプルの91%はその下にあります.
サイトのランキングを確認する
アクション可能な発見と優先修正を含む無料のAI搭載SEOレポートを取得
サインアップ不要.