EMAX Studio Blog

llms.txt完全ガイド(実例付き):フォーマット、ホスティング、AIクローラーの使い方

Manuel Mrosek · 2026-08-21 · 閲覧数

llms.txt完全ガイド(実例付き):フォーマット、ホスティング、AIクローラーの使い方

llms.txtは、ドメインのルート(https://yourdomain.com/llms.txt)に置くプレーンテキストのMarkdownファイルで、AIモデルに最も重要なコンテンツのきれいで厳選された地図を与えます。これは提案された慣行——2024年9月にAnswer.AIのJeremy Howardが導入——であって、公式のウェブ標準ではなく、現在どの主要AIプロバイダーも読むこと、あるいは持つことでランキングが改善することを保証していません。

その率直さを最初に述べておくことが重要です。というのも、大半のllms.txtガイドはこれを過大に売り込むからです。このガイドは、ファイルの正確な書き方、どこにホストするか、robots.txtsitemap.xmlとどう関係するか、そして今日それが現実に何をし何をしないのかを示します。より広い戦略的な全体像が欲しいなら、これと並んでウェブサイトをAIに発見されやすくする方法のガイドをお読みください。

llms.txtとは何か、どんな問題を解決するのか

大規模言語モデルがあなたのサイトについての情報を必要とするとき、2つの問題に直面します。第一に、HTMLページはノイズが多い——ナビゲーションメニュー、クッキーバナー、広告、JavaScript、フッターが実際のコンテンツを埋めてしまいます。第二に、モデルは限られたコンテキストウィンドウの中で動くため、サイト全体を取り込めません。乱雑なHTMLを推論時にきれいなシグナルに変換するのは高コストでエラーが起きやすいのです。

llms.txtは、モデルのために厳選を代行することでこれに対処します。クローラーにどのページが重要かを推測させる代わりに、平易な言葉の説明とともに主要なリソースを列挙した、短く構造化されたMarkdown文書を手渡します。ピクセルをレンダリングするブラウザ向けではなく、テキストを読む機械のために書かれた目次だと考えてください。

範囲について正確を期す価値があります。llms.txt推論時の取得——AIアシスタントが質問に答えており、あなたの製品、ドキュメント、ポリシーについての関連する最新の情報を引き込みたいその瞬間——を対象としています。学習データを制御する仕組みとして設計されたものではありません。その役目は依然としてrobots.txtと、より新しいAI固有のクローラー指示に属します。

llms.txtのファイルフォーマット

仕様はシンプルで人間が読めるMarkdown構造を定義しています。必須の部分といくつかの任意の部分があり、パーサーが依存できるよう順序は固定されています。

順序どおりのフォーマット:

  1. プロジェクトまたはサイトの名前を持つH1。 これが唯一、厳密に必須の行です。
  2. 短い要約を持つ引用ブロック(>)。 サイトやプロジェクトが何であるかを述べる1〜2文。任意だが強く推奨されます。
  3. ゼロ個以上の段落の追加の文脈(見出しなし)。残りのファイルを解釈するためにモデルが必要とする詳細を与えます。
  4. H2セクション、それぞれがリンクのMarkdownリストを含む。 各リスト項目はハイパーリンクで、任意でコロンと短い説明が続きます。
  5. ## Optionalセクション。 ここのリンクは明示的にスキップ可能と印付けされます——コンテキストの余裕が乏しいモデルは、本質的なものを失うことなくこれらを落とせます。

重要な設計上の選択は、すべてが標準的なMarkdownであることです。つまり、同じファイルがテキストエディタで人間に読め、しかもモデルには容易に解析できます。LLMはすでにMarkdownに堪能だからです。

併用パターン:llms-full.txtと.mdページ

llms.txtと並んで、2つの関連する慣行がしばしば登場します。

  • llms-full.txt — リンクだけでなく実際の本文全体を含む、単一のより大きなファイル。1回のフェッチでモデルにすべてを持たせたいときに有用ですが、ファイルがはるかに大きくなる代償があります。
  • ページのクリーンな.mdバージョン — 任意のHTMLページのMarkdownコピーを、同じURLに.mdを付けて提供する慣行(例:about.html.md)。llms.txt内のリンクをこれらのクリーンなバージョンに向ければ、モデルはHTMLをまったく解析する必要がありません。

実例ファイル

以下は小さなSaaS製品向けの最小限のllms.txtです。これは誰もが作れるべきベースラインです。

# Acme Analytics

> Acme Analytics is a privacy-first web analytics tool for small
> teams. It is cookieless, GDPR-compliant, and self-hostable.

Acme replaces heavyweight analytics suites with a single lightweight
script. Pricing is flat-rate per site with no event caps.

## Docs

- [Quick Start](https://acme.example/docs/quickstart.md): Install the
  script and see your first data in under five minutes.
- [API Reference](https://acme.example/docs/api.md): Full REST API for
  querying metrics programmatically.
- [Self-Hosting Guide](https://acme.example/docs/self-host.md): Run
  Acme on your own infrastructure with Docker.

## Product

- [Features](https://acme.example/features.md): What Acme measures and
  how it protects visitor privacy.
- [Pricing](https://acme.example/pricing.md): Flat monthly pricing per
  tracked site.

## Optional

- [Changelog](https://acme.example/changelog.md): Release history.
- [Company](https://acme.example/about.md): Team and founding story.

2つ目の例は、今度はソフトウェア製品ではなく地域のサービス業向けです。説明が、AIアシスタントが顧客の質問に直接答えるために必要とする事実をどう運んでいるかに注目してください。

# Harbor Dental Clinic

> Harbor Dental is a family dental practice in Portland, Oregon,
> offering general, cosmetic, and emergency dentistry since 2004.

## Services

- [General Dentistry](https://harbordental.example/general.md):
  Cleanings, fillings, crowns, and preventive care.
- [Emergency Care](https://harbordental.example/emergency.md):
  Same-day appointments for pain, breaks, and lost fillings.
- [Cosmetic Dentistry](https://harbordental.example/cosmetic.md):
  Whitening, veneers, and Invisalign.

## Visit

- [Hours & Location](https://harbordental.example/contact.md): Open
  Mon-Fri 8am-5pm at 120 Harbor St, Portland OR 97201.
- [New Patients](https://harbordental.example/new-patients.md):
  Insurance accepted, intake forms, and what to expect.

## Optional

- [Patient Reviews](https://harbordental.example/reviews.md)
- [Blog](https://harbordental.example/blog.md)

3つ目は、なお有効な絶対的最小限——H1と1つのセクション——まで削ぎ落としたものです。これは正当です。使えるファイルにするために、すべてのセクションが必要なわけではありません。

# Jane Doe — Freelance Illustrator

> Editorial and children's book illustrator based in Berlin,
> available for commissions.

## Links

- [Portfolio](https://janedoe.example/work.md): Selected published work.
- [Rates & Contact](https://janedoe.example/contact.md): Commission
  pricing and how to get in touch.

どこにホストするか

ファイルはドメインのルートにホストします:https://yourdomain.com/llms.txt。これはrobots.txtとまったく同様に、この慣行が指定する唯一の場所です。サブディレクトリに置いてはいけませんし、名前を変えてもいけません——ツールはその正確なパスを探します。

いくつかの実践的なホスティング上の注意です。

  • コンテンツタイプtext/plain(またはtext/markdown)で提供します。大半の静的ホストは.txtファイルに対してこれを自動的に行います。
  • 正規のURLでHTTP 200を返し、認証、地域ブロック、robots.txtのdisallowルールでブロックされていないことを確認します。
  • 複数のサブドメイン(例:docs.app.)を運用しているなら、各サブドメインはそのホストにスコープした独自のllms.txtを持てます。
  • サイトマップを保守するのと同じように、バージョン管理下に置き、重要なURLが変わったら更新します。

llms.txtがrobots.txtやsitemap.xmlとどう違うか

これら3つのファイルはすべてドメインルートに置かれ、すべて自動化されたクライアントに語りかけます。だからこそ混同されるのです。これらは異なる問題を解決し、代替ではなく補完的です。3つとも保持しましょう。

側面 llms.txt robots.txt sitemap.xml
主な対象 AIモデル / LLMアシスタント 検索・クローラーボット 検索エンジンのクローラー
フォーマット Markdown(人間+機械可読) プレーンテキストの指示 XML
目的 推論時の読み取り用に主要コンテンツを厳選する パスのクロールを許可または拒否する 発見のため索引可能な全URLを列挙する
説明を含むか はい、リンクごとに文章の説明 いいえ いいえ(URL+メタデータのみ)
選別性 高度に厳選、最重要のものだけ サイト全体にわたるルール 網羅的、理想的には全ページ
公式標準か 提案された慣行、批准されていない 事実上の標準(RFC 9309) 認められた標準(sitemaps.org
プロバイダーによる強制か どのプロバイダーも読む保証なし 広く尊重される 広く尊重される

考え方のモデルはこうです。sitemap.xmlは「これが存在するすべてだ」と言い、robots.txtは「これがあなたがアクセスしてよいものと、いけないものだ」と言い、llms.txtは「これが実際に重要なものと、それが何を意味するかだ」と言います。サイトマップは網羅的で説明なし、llms.txtは選別され注釈付きです。

クロール制御について1つ重要な明確化を。llms.txtは誰かを何かからブロックしません——権限を付与も剥奪もしません。AI企業が学習のためにサイトをクロールするかどうかを制御したいなら、それはrobots.txtのユーザーエージェントルール(GPTBotClaudeBotGoogle-Extendedのようなボット向け)と、増えつつある別の提案されたai.txt形式の権限層で行います。llms.txtを同意またはオプトアウトのファイルとして扱わないでください。

AIクローラーとアシスタントは実際にどう使うのか

ここで正直さが不可欠です。技術的に可能なことと、本番で確認されていることのギャップが広いからです。

今日起きていること。 開発者向けのツールの一群がllms.txtを読むようになりつつあります。ドキュメントプラットフォーム、いくつかのAIコーディングアシスタントやIDE統合、そして一部の取得フレームワークは、ドメインを指し示すと/llms.txtをフェッチし、それを使ってどのページをコンテキストに引き込むかを決めます。ドキュメントのURLをAIコーディングツールに貼り付けて、正しい参照ページが素早く見つかるのを見たことがあるなら、llms.txtがその理由かもしれません。

確認されていないこと。 執筆時点で、主要な消費者向けAI検索製品は、一般的なウェブの回答においてllms.txtをランキングまたは取得のシグナルとして使うと公に約束していません。いくつかの大手プロバイダーの人々による公の発言は懐疑的で、すでにHTMLから大規模にコンテンツを抽出していると述べています。ですから、llms.txtを公開することがそれ自体で、汎用AIアシスタントの回答であなたがより多く引用されるようになるとは期待すべきではありません。

それでも行う価値がある理由。 コストはほぼゼロ——小さなMarkdownファイル1つ——であり、この慣行は有用な演習を強います。サイト上のどの10〜20のURLが実際にあなたの価値を表すかを決め、それぞれに1行の説明を書くことです。その明快さは、誰がファイルを読もうと、あなたのHTML、メタデータ、コンテンツ戦略の助けになります。そして採用が広がれば、あなたはすでに有利な位置にいます。これは、より広い生成エンジン最適化の背後にある、低コストで選択肢の多い論理と同じです。発見の向かう先だからこそ、AIシステムがコンテンツをどう消費するかに向けて最適化するのです。

現時点でAIシステムが確認された効果とともに解析するコンテンツについては、構造化データがllms.txtより重い役割を果たします。AI検索エンジンが実際に読むスキーマ・マークアップの分解をご覧ください——有効なスキーマをきれいなllms.txtと組み合わせれば、確認済みと新興の両チャネルをカバーできます。

現在の採用状況と限界

期待を適切に調整するために、現状を平易な言葉で述べます。

  • これは提案であって、義務ではない。 統治団体も、適合テストも、持たないことへのペナルティもありません。仕様は公開リポジトリにあり、進化しています。
  • 読むことは消費者側のオプトインである。 それを読むツールやモデルは、選んでそうしています。多くはしません。
  • ランキングシグナルではない。 どの検索・AIプロバイダーも、可視性に影響すると確認していません。そうでないという主張は、事実ではなくマーケティングとして扱いましょう。
  • ずれ得る。 サイトマップと同様、死んだ、または古びたURLを指すllms.txtは、ないより悪い。保守が必要です。
  • 良いコンテンツや構造化データの代わりにはならない。 これはポインタファイルです。それが指すページが薄ければ、ポインタは役立ちません。

このどれもllms.txtを悪いアイデアにはしません。低リスクで将来志向の衛生的な慣行——保証された成長のレバーというより、2006年にサイトマップを追加することに近い——にするのです。公開し、正確に保ち、エコシステムが追いつくのを待ちましょう。

よくある質問

llms.txtは公式のウェブ標準ですか。

いいえ。2024年9月に導入され公開仕様で保守されている提案された慣行ですが、W3CやIETFのような標準化団体によって批准されていません。RFC 9309として形式化されたrobots.txtとは違い、llms.txtは公式の地位を持たず、どのプロバイダーもサポートする義務はありません。

llms.txtを追加すればGoogleやAI検索の順位が改善しますか。

そうであるという証拠はなく、どの主要プロバイダーも一般的なウェブの回答におけるランキングまたは取得のシグナルとして確認していません。SEOの手法としてではなく、低コストと将来の可能性のために追加すべきです。実際の可視性の向上は、依然として質の高いコンテンツ、構造化データ、技術的な健全性から来ます。

llms.txtがあれば、robots.txtとsitemap.xmlはまだ必要ですか。

はい、絶対に。3つのファイルは異なる補完的な目的を果たします。sitemap.xmlは発見のため全URLを列挙し、robots.txtはクローラーのアクセスと権限を制御し、llms.txtはAIの読み取り用に主要コンテンツを厳選し説明します。llms.txtは何の権限も付与しないため、決してrobots.txtの代わりにはなりません。

llms.txtファイルは正確にどこに置くべきですか。

ドメインのルート、https://yourdomain.com/llms.txtで提供し、プレーンテキストまたはMarkdownのコンテンツタイプでHTTP 200を返すこと。サブディレクトリや認証の背後にあってはいけません。複数のサブドメインがあれば、それぞれがそのホストにスコープした独自のファイルをホストできます。

llms.txtファイルはどのくらいの長さにすべきですか。

短く厳選して保ちましょう——通常は最重要のURL 10〜30個、それぞれに1行の説明です。要点は選別なので、全ページを列挙する誘惑には抗いましょう。リンクではなく全文を提供したいなら、別のllms-full.txtファイルを使い、主要なllms.txtをスリムな索引に保ちます。

これらすべてを一人で手書きし保守する必要はありません。emax.studio のようなツールは、llms.txtが指し示すべきAI最適化されたコンテンツ——きれいなページ、構造化された要約、回答を先頭に置いたコピー——を生成できるため、ファイルは本当に引用に値する素材にリンクします。

emax.studio で最初のAI搭載マーケティングキャンペーンを作成しましょう——無料プランをご利用いただけます。

シェア:

AIビデオリールを作成する準備はできましたか?

5クレジット無料。クレジットカード不要。

無料で始める