AI対応度ガイド:ChatGPTやPerplexityに引用されるには
AIアシスタントが推薦するのは、クロールでき、解析でき、信頼できるサイトだけです。この3つは別々の問題であり、多くのサイトは気づかないまま少なくとも1つでつまずいています。
ChatGPT、Perplexity、GoogleのAI検索結果といったアンサーエンジンがサイトをクロールし、理解し、引用できる状態を「AI対応」と呼びます。これは3つの独立した層で構成されます。robots.txtが制御する「アクセス」、構造化データとメタデータが担う「理解」、そしてllms.txtが提供する「ガイダンス」です。各層は互いに独立して壊れるため、ほとんどのサイトには少なくとも1つの穴があります。
なぜ独立した分野になったのか
かつてはGoogle検索だった質問のかなりの部分が、いまはAIアシスタントの中で回答され、そこには数件の引用元だけが表示されます。その引用枠に入ることが、新しい「検索1位」です。アンサーエンジンは候補ページの発見に検索インデックスを利用するため、従来のSEOも引き続き重要ですが、両者の重なりは部分的です。通常の検索では問題なく上位表示されているのに、学習データ論争のさなかの2年前にクローラーをブロックしたせいで、AIの回答からは完全に消えている——そんなサイトが実際にあるのです。
第1層:アクセス——誰がサイトを読めるか
主要なAIシステムはそれぞれ固有のユーザーエージェントでクロールし、robots.txtではボットごとに可否を決められます。決定的に重要なのは、各ボットが「何のためのボットか」という区別です。学習用ボットのブロックは将来のモデルの重みに影響するだけですが、検索用ボットのブロックは、そのエンジンの回答から今日あなたを消し去ります。
| クローラー | 運営元 | ブロックすると |
|---|---|---|
GPTBot、OAI-SearchBot | OpenAI | ChatGPTがサイトを読めず、引用もできない |
ClaudeBot | Anthropic | Claudeがサイトを読めず、引用もできない |
PerplexityBot | Perplexity | Perplexityの回答に登場しなくなる |
Google-Extended | Geminiの学習のみ。AI Overviewsには影響なし | |
CCBot | Common Crawl | 多くの学習データセットから外れる。検索への影響なし |
最も多い自滅パターンは、学習データへの意思表示として2023年に追加した「AIボット全面ブロック」のrobots.txtが、同じユーザーエージェントが検索プロダクトを支えるようになった今も残っているケースです。ボットごとに、それが今日何をしているかに基づいて判断してください。
第2層:理解——機械は意味を解析できるか
クローラーが入れるようになったら、次の問題は「ページの意味を機械が取り出せるか」です。アンサーエンジンは人間のようにページを読みません。最も確実に解析されるシグナルは次の3つです。
- JSON-LD構造化データ。schema.orgのマークアップ(Organization、FAQPage、Article、Productなど)は曖昧さのない機械可読の事実であり、回答に最もきれいに抽出されます。中でもFAQマークアップは、文字どおり質問と回答の形をしているため特に効果的です。
- 正直なメタデータ。具体的なtitleタグ、実のあるメタディスクリプション、canonical URL、そして1ページに1つの明確なH1。これらが欠けると、AIのスニペットはページ内の任意のテキストにフォールバックします。
- 回答の形をしたコンテンツ。最初の段落で答えを述べるページは引用され、長い前置きの下に答えを埋めたページは飛ばされます。比較表とFAQセクションは、構造からして抽出に向いています。
第3層:ガイダンス——地図を残したか
llms.txtファイルは、サイトの厳選インデックスをmarkdown形式でモデルに渡します。3つの層の中で最も新しく、最も標準化が進んでいない層であり、だからこそ第1層ではなく第3層なのです。アクセスと理解を整えた後に取り組むものであって、その代わりにはなりません。ジェネレーターを使えば数分で完了し、これで3層が揃います。
優先順で直すチェックリスト
3つの層を一度に完璧にする必要はありません。効果の大きい順に、次の手順で進めてください。
- AI対応度チェックにドメインを入力する。3つの層すべてを約10秒で採点します。
- 引用してほしいAI検索クローラーのブロックを解除する。robots.txtを1回編集するだけで済む、単体で最も効果の大きい修正です。
- 主要なページタイプにJSON-LDを追加する。トップページのOrganizationと、実際に質問へ答えているページのFAQPageから始めます。
- チェックで指摘されたメタデータの欠落(title、ディスクリプション、canonical)を埋める。
- サイトマップが有効であることと、robots.txtで宣言されていることを確認する。アンサーエンジンはあなたを見つけるのに検索インデックスを使います。
- 最後にllms.txtを追加し、チェックを再実行してすべて緑になったことを確認する。
AI対応は小手先の技ではない
秘密のmetaタグは存在しません。質問に答えるために作られたシステムが評価するのは、良いテクニカルSEOが昔から評価してきたものと同じです。到達可能なページ、曖昧さのない構造、実際に何かへ答えているコンテンツ。違うのは許容度です。人間の訪問者はメタディスクリプションの欠落を気に留めませんが、抽出パイプラインは黙って次の情報源へ移ります。AI対応とは、ミスへの許容度を一段と絞った技術的な衛生管理にほかなりません。