Tenten AIGEO
ブログに戻る
テクニカルAEO比較・検討

llms.txtとllms-full.txtの違いとは?2つのファイルの役割と記載すべき内容

llms.txtはAI向けのサイト索引、llms-full.txtは一括で読み込ませる全文ドキュメントです。2つのファイルの役割、記載すべき内容、どちらを用意すべきかの判断基準、よくある4つのミスを解説します。

Tenten GEO 編集部公開日 2025-03-275 分で読めます
左に簡略化したWebサイトの索引図、右に全コンテンツを一本の長いファイルへまとめた図を配置し、llms.txtとllms-full.txtの役割分担を示した模式図

llms.txtとllms-full.txtは、どちらか一方を選ぶものでも、新旧のバージョン違いでもありません。llms.txtはAIが参照する「地図」です。リンクと短い説明文を使い、Webサイトのテーマや重要なページを言語モデルに伝えます。一方、llms-full.txtは「本全体」に当たります。引用してほしいコンテンツをプレーンテキストの1ファイルにまとめ、モデルが一度に読めるようにします。llms.txtへ全文を詰め込む、llms-full.txtをサイトマップ代わりにするといった混同は、監査の現場で特によく見かける無駄の多い実装です。

地図と本:2つのファイルにおける基本的な役割分担

llms.txtは、Jeremy Howard(Answer.AI)が2024年九月に提案した仕様です。Webサイトのルートディレクトリへ配置するMarkdownファイルで、URLは「your domain/llms.txt」に固定されます。役割はコンテンツそのものではなく、索引を提供することです。モデルのコンテキストウィンドウには上限があり、複雑なHTML、ナビゲーション、広告、トラッキングコードを含むサイト全体を読み取れるとは限りません。llms.txtは整理された構造によって、そのサイトが何を提供しているのか、どのページが重要なのか、各ページに何が書かれているのかを伝えます。機械が読むために用意する目次ページと考えると分かりやすいでしょう。

llms-full.txt(配置先は「your domain/llms-full.txt」)は、反対のアプローチを取ります。AIに取り込んでほしいページ、一般的には製品ドキュメント、APIリファレンス、チュートリアル、ナレッジベースなどをMarkdownへ変換し、連続した1つのファイルにまとめます。モデルやエージェントがこのファイルを取得すれば、ページごとのクロールやHTMLの整形をせずに、一連のドキュメント全体を読めます。ユーザーがChatGPTやPerplexityへドメインを入力した場合や、エージェントが製品説明を参照する場合にも、扱いやすい情報源になります。つまり、「目的のページへ案内する」のではなく、「完全なコンテンツを一度に渡す」ためのファイルです。

  • 目的:llms.txtは「発見とナビゲーション」、llms-full.txtは「コンテンツ全体の取り込み」を担います。
  • 内容:前者はリンクと説明文、後者は各ページの全文で構成します。
  • 容量:前者は通常数KBですが、後者は数百KB、あるいはそれ以上になる場合があります。
  • 更新頻度:前者は構造が安定しており変更も少ない一方、後者はコンテンツを更新するたびに再生成する必要があります。
  • 適したサイト:前者はあらゆるWebサイトで利用できます。後者は特に「多数のドキュメントやナレッジベース」を持つ製品で費用対効果を得やすいでしょう。

llms.txtに記載すべき内容

llms.txtには慣例的なフォーマットがあり、それに沿うことでモデルが解析しやすくなります。ファイル全体は上から順に、H1見出し(ブランド名または製品名)、概要文、セクション別のリンク一覧で構成します。重要なのは、情報を厳選することです。サイトマップの内容をすべて流し込むのではなく、何を優先して見せるかを編集します。リンクが多すぎると、本当に読ませたいページの重要性が薄れてしまいます。

  1. H1見出し:ブランド名やプロジェクト名を「#製品名」のように、1行で明確に記載します。
  2. 概要ブロック:このWebサイトが何を提供し、誰を対象としているのかを導入文で説明します。モデルが最初に読み、引用する可能性も高い文章なので、繰り返し推敲する価値があります。
  3. セクション別リンク:「##」を使い、「ドキュメント」「導入事例」「料金」などのセクションに分けます。各リンクには「-[クイックスタート](https://.../quickstart):5分で最初の接続を完了できます。」のように、内容を示す短い説明文を添えます。
  4. Optionalブロック:優先度が低く、省略可能なリンクはOptionalという名前のブロックへまとめます。モデルのコンテキストに余裕がない場合、このセクションが最初に読み飛ばされます。

llms-full.txtに記載すべき内容

llms-full.txtにはドキュメントの全文を収録しますが、実際に使えるファイルにするには、いくつかの実務上のポイントがあります。まず、HTMLではなくMarkdownを使用します。見出しの階層、コードブロック、リストが保持され、モデルが構造を理解しやすくなるためです。次に、各ページで繰り返されるナビゲーション、フッター、ポップアップを削除し、本文だけを残します。また、ファイルサイズにも注意が必要です。全体がモデルのコンテキスト長を超えると、末尾のコンテンツが切り捨てられます。容量が大きい場合は、全体版に加えて、/llms-full-api.txtや/llms-full-guides.txtのようにテーマごとの小さなファイルへ分割することをおすすめします。現在の主要なドキュメントフレームワークの多くは、このファイルを自動生成できます。手作業でコピー&ペーストすると、公開直後から陳腐化が始まるため避けましょう。

llms.txtとllms-full.txtの違いを、目的、内容、ファイルサイズ、更新頻度の観点から比較したインフォグラフィック
llms.txtはナビゲーション、llms-full.txtは一括取り込みを担います。4つの観点から役割の違いを整理します。

どちらを用意すべきか

すべてのWebサイトに両方のファイルが必要なわけではありません。作るものを増やしても、それだけで評価が上がるとは限らず、保守コストは確実に発生します。判断基準はシンプルです。「AIに全体像を理解してもらい、正確に引用してほしい」まとまった量の専門的なコンテンツがあるかどうかです。該当するならllms-full.txtへ投資する価値があります。画像中心のページが数点あるだけなら、別の施策を優先すべきでしょう。

  • 数ページだけのマーケティングサイト:まずはllms.txtのみを作成します。場合によっては作成を見送り、クリーンなHTMLと構造化データの整備を優先しても構いません。
  • 製品ドキュメント、APIドキュメント、ナレッジベースを持つSaaS:両方を用意します。特に価値が高いのはllms-full.txtです。AIが製品に関する質問へ回答する際に、情報全体を根拠として参照できるようになります。
  • ファイルサイズが非常に大きい場合:llms.txtを全体の索引として使い、llms-full.txtはテーマ別に複数のファイルへ分割して、コンテキスト長の超過を防ぎます。
  • コンテンツの更新頻度が高い場合:llms-full.txtの自動生成をビルドプロセスへ組み込みます。手作業による保守では、いずれ必ず内容が古くなります。

よくある4つのミス

  • llms.txtへ全文を詰め込む:ファイルが長く解析しにくくなり、索引としての意味を失います。
  • llms-full.txtが大きすぎて途中で切れる:モデルが読めるのは前半だけとなり、それ以降のコンテンツは存在しないものとして扱われます。
  • ファイルが古くなる:元のコンテンツを変更してもファイルを更新しなければ、モデルが誤った旧情報を参照します。何も用意しない場合より悪い結果になりかねません。
  • 基本施策の代わりに使う:この2つのファイルは、クリーンなHTML、正確なSchemaマークアップ、robots.txtの適切な設定を代替しません。あくまで追加施策であり、土台ではありません。
顧客の2つのファイルを確認すると、問題の半分はフォーマットの誤りではなく、まったく保守されていないことにありました。公開当日はきれいに整っていても、3か月後には実際のコンテンツと一致しなくなっているのです。AIが参照するファイルは、常に更新され続ける必要があります。Tenten GEO Audit Team

公開後の検証と運用方法

ファイルの公開はスタート地点にすぎません。まず、サーバーがプレーンテキスト(text/plainまたはtext/markdown)としてレスポンスを返すこと、URLへ直接アクセスできること、CDNやファイアウォールに遮断されていないことを確認します。次に、実際の環境で検証します。ChatGPT、Perplexity、Claudeへ自社ドメインを入力し、製品に関する質問への回答がllms-full.txtの内容と一致するかを確認してください。最後に、「2つのファイルを再生成する」作業をコンテンツ公開時の定型プロセスへ組み込み、Webサイトとともに更新される状態を保ちます。AIエンジンから見て、自社サイトのどこに情報が不足しているのかを把握したい場合は、Tenten GEOの30分GEO診断で、地図と本全体をまとめて棚卸しできます。相談予約は/contactから受け付けています。

よくある質問

llms.txtとllms-full.txtの違いは何ですか?
llms.txtはWebサイトの索引です。リンクと説明文を使い、重要なページをAIへ伝えます。llms-full.txtは各ページの全文を1つの大きなファイルにまとめ、モデルがコンテンツ全体を一度に読めるようにします。前者はナビゲーション、後者は一括取り込みを担います。
2つのファイルを両方とも用意する必要がありますか?
必須ではありません。数ページだけのマーケティングサイトなら、llms.txtだけでも十分です。製品ドキュメントやナレッジベースを多数持つSaaSでは、両方を用意する価値があります。特にllms-full.txtがあれば、AIは製品に関する質問へ回答する際に、コンテンツ全体を根拠として参照できます。
llms.txtでGPTBotなどのAIクローラーをブロックできますか?
できません。llms.txtはコンテンツの文脈を提供するだけで、アクセスを制御する機能はありません。GPTBotやPerplexityBotによるクロールの可否は、robots.txtのUser-agentルールで指定する必要があります。両者の役割は異なります。

次の一手へ

あなたのブランドはAIの回答にどれだけ登場していますか?

30分のGEO診断で、主要AIエンジンにおける可視性の課題と、優先して改善すべきポイントを確認します。

30分の診断を予約