著者:吉田 清登(株式会社FID CMO / Genview PM) 公開:2026-05-25 更新:2026-09-24

Botの役割はAIごとに違います。ただ、設定で分けても、そのとおりに扱われるとは限りませんでした。

robots.txt で99個のBotを断っていた amazon.co.jp を、ChatGPTは108回答中41回答で出典にし、Geminiは151回答中0回答でした(2026年9月)。

この記事は、各社の公式ドキュメントと海外の調査を整理したものに、自社の観測を1つ足したものです。AIの内部の仕組みを説明したものではありません。

99個のBotを断っていたAmazonを、ChatGPTは出典にしていた

サイトには robots.txt というファイルを置けます。「このBotは入らないでください」と書いておくファイルです。amazon.co.jp の robots.txt(2026年9月18日取得)には、サイト全体に入らないでくださいと書かれたBotの名前が99個ありました。Botごとに制御しようとした、かなり極端な例です。

私たちは動画配信サービスについての30問を、ChatGPTとGeminiに6回ずつ聞いています。その回答で、Amazon Prime Videoに触れた回答が、amazon.co.jp を出典にしていたかを数えました(この観測はAmazonが生成AIのボットをブロックしているのを、知っていますか?にまとめています)。

Amazon Prime Video に触れた回答のうち、amazon.co.jp を出典にした回答 ChatGPTは触れた108回答のうち41回答が amazon.co.jp を出典にした。Geminiは触れた151回答のうち0回答。動画配信30問をそれぞれ6回聞いた回答で数えた。 Amazon Prime Video に触れた回答 amazon.co.jp を出典にした回答 ChatGPT 108回答中 41回答 Gemini 151回答中 0回答 0 50 100 150 回答
図1:Amazon Prime Video に触れた回答のうち、amazon.co.jp を出典にした回答
動画配信30問を ChatGPT・Gemini に6回ずつ。「出典にした」は、回答に付いた引用URLに amazon.co.jp が1つでも入っていた回答の数。くわしくはAmazonが生成AIのボットをブロックしているのを、知っていますか?

同じように断られていて、Geminiは出典にせず、ChatGPTは出典にしました。OpenAIの説明を読むと、手がかりが2つ書かれています。

  • OAI-SearchBotを止めたサイトも、「ナビゲーション用のリンク」としては表示されることがある
  • ChatGPT-Userはユーザーの操作で動くため、「robots.txtのルールが当てはまらないことがある」

※ 出典:OpenAI「Overview of OpenAI Crawlers」

ただし、私たちのデータからは、ChatGPTがどの経路で amazon.co.jp を出典にしたのかまでは分かりません。分かるのは、robots.txt を書くだけでは、AIでの扱いまでは決められなかったということです。

それでもBotの種類を知る意味はどこにあるのか

GEO対策を調べていると、「FAQの形にしろ」「定義文を入れろ」「構造化データを実装しろ」という話が並びます。どれも実務では使われていますが、なぜそれが効くと言われているのかまで説明されていることは少ないと感じています。

その「なぜ」をたどると、AIがどうやってWebから情報を取っているかにぶつかります。そこに出てくるのがAIクローラーのBotです。2026年時点で主要なものだけで10種類以上あり、動くタイミングも目的も違います。

ここで大事なのは、Botの種類を知るのは、Botを制御するためではないということです。上のAmazonの例のとおり、設定を書いても、AIによって扱いは違いました。種類を知るのは、「自分のページが、いつ、どんな目的で読まれているのか」を把握するためです。

AIクローラーの「3+1」分類

AIクローラーのBotは、いつ動くかと何のために動くかで4つに分けられます。3種類のAI用Botと、その土台になる従来の検索エンジンのBotです。

4種類のBotが、いつページを読みに来るか 学習型は数か月から数年をかけて集める。インデックス型はふだんから巡回して索引を作り、質問のときにそこを参照する。代理アクセス型は質問の瞬間だけページを取りに来る。従来の検索エンジンのBotは、その全体の土台としてふだんから巡回している。 ② 学習型(GPTBot・ClaudeBot・Google-Extended) 数か月〜数年かけて集め、AIの知識になる ① インデックス型(OAI-SearchBot・PerplexityBot・Claude-SearchBot) ふだんから巡回して、自前の索引を作る ③ 代理アクセス型(ChatGPT-User・Claude-User) 事前の索引を持たず、その場で取りに来る 【土台】従来の検索エンジン(Googlebot・Bingbot) 検索エンジンとして、ふだんから巡回している ふだん 質問の瞬間
図2:4種類のBotが、いつページを読みに来るか
各社の公式ドキュメントの記述をもとに整理したものです

AIクローラーBotの「3+1」分類

分類 代表的なBot 動くタイミング
① インデックス型 OAI-SearchBot / PerplexityBot / Claude-SearchBot 常に巡回 → 質問のときに参照
② 学習型 GPTBot / ClaudeBot / Google-Extended 長い時間をかけて収集 → AIの知識へ
③ 代理アクセス型 ChatGPT-User / Claude-User 質問の瞬間に取りに来る
【土台】従来型 Googlebot / Bingbot 検索エンジンとして常に巡回

① インデックス型:事前に集めて、質問のときに参照する

OAI-SearchBot(OpenAI)・PerplexityBot・Claude-SearchBot(Anthropic)が当てはまります。ユーザーが質問する前からWebを巡回して自前のデータベースを作り、質問が来たらそこから取り出して回答を組み立てます。

OAI-SearchBot

ChatGPT Search 向けの索引を作るBotです。OpenAIの公式ドキュメントに、学習用の GPTBot とは別のBotだと明記されています。なお ChatGPT Search が他社の検索インデックスも併用しているという話は各所で報じられていますが、公式ドキュメントで明示されているわけではありません。

PerplexityBot

Perplexity の検索・回答エンジンの情報源です。公式の説明では、基盤モデルの学習ではなく検索インデックスの用途とされています。

Claude-SearchBot

Anthropic の公式ドキュメントでは、検索インデックス用のBotとして分類されています。代理アクセス型の Claude-User とは役割が違います。

公式の説明から読み取れること

各社の説明は、引用するときに見ているものとして次のような点を挙げています。見出しの直下に結論があること、質問と答えが組になっていること、数字と出典があること、そのドメインが信頼できることです。

※ これらが実際に引用されやすさを変えるかどうかは、私たちはまだ確かめていません。

② 学習型:長い時間をかけてAIの知識になる

GPTBot(OpenAI)・ClaudeBot(Anthropic)・Google-Extended(Google)が当てはまります。数か月から数年の単位でWebのデータを集め、AIモデルの基礎になる知識として学習させるためのBotです。

厳密には、この3つは同じものではありません。GPTBot と ClaudeBot は独立したクローラーですが、Google-Extended はクローラーそのものではなく、Googleのクローラーに対してAI学習での利用を許可するかどうかを指定するためのトークンです。この記事では便宜上まとめていますが、技術的な位置づけは違います。

公式ドキュメントに書かれていること

  • OpenAI:GPTBot は「OpenAIの生成AIの基盤モデルをより有用かつ安全にするために使用する」
  • Google:Google-Extended は「GeminiモデルおよびVertex AIのトレーニングと、AI回答のグラウンディングに使用する」

Grok系のBotについて

xAI の Grok 系Botについては、公式ドキュメントが見つかりませんでした。X(旧Twitter)上の言及が影響するという見方もありますが、確かめられていないので、この記事では扱いません。

③ 代理アクセス型:質問の瞬間に取りに来る

ChatGPT-User(OpenAI)と Claude-User(Anthropic)が当てはまります。事前のデータベースを持たず、ユーザーが「このURLを読んで」と指示したその瞬間に、ユーザーの代わりにそのページへ直接アクセスします。

Anthropic は2026年2月に公式ドキュメントを更新し、ClaudeBot(学習用)・Claude-SearchBot(検索インデックス用)・Claude-User の3Bot体制と、それぞれの役割を明示しました。このうち代理アクセス型にあたるのが Claude-User で、「Claudeのユーザーが質問した際に、ウェブサイトへのアクセスを支援するBot」と定義されています。

冒頭のAmazonの例で、OpenAIの説明として引いた「ChatGPT-Userはユーザーの操作で動くため、robots.txtのルールが当てはまらないことがある」という記述は、この型の話です。

GEO・AI検索のご相談。自社サイトの構造や情報設計、無料で相談してみませんか? 無料相談はこちら

【土台】従来の検索エンジンのBot

Googlebot と Bingbot は、AI検索用ではなく従来の検索エンジンのためのBotです。それでもこの記事で別枠にしているのは、AI各社の回答が、検索エンジン側の索引とまったく無関係には動いていないためです。

くわえて、到達しているページ数が桁違いです。次の節で見るCloudflareの調査では、Googlebot がユニークページの11.6%に到達していたのに対し、GPTBot は3.6%でした。

私たちの15業界450問の調査では、AIが引用したURLの75.0%は、同じ質問の検索結果で上位11位以下のサイトでした。検索の上位にいることは、AIに引用されることを保証しません。ただ、検索エンジンに載っていないページがAIの選択肢に入りにくいことは、Botの到達率から見て確かです。

Botはどのくらい来ているのか(海外の調査)

自社サイトへのBotの来訪は、私たちはまだ数えていません。ここでは海外の調査を2つ引きます。

Botごとのユニークページ到達率(Cloudflare、2025年10〜11月)

Bot ユニークページ到達率
Googlebot 11.6%
GPTBot 3.6%
Bingbot 2.6%
ClaudeBot 2.4%
Meta-ExternalAgent 2.4%
PerplexityBot 0.06%

Googlebot の到達率が、AI各社のBotより大きく上にあります。Bingbot も ClaudeBot と同じかそれ以上です。従来の検索エンジンのBotを「土台」として別枠にしているのは、この差が理由です。

1サイトあたり1日のヒット数の中央値(Digital Applied、12サイト・30日間、2026年4月26日公開)

Bot 1日あたりのヒット数(中央値)
GPTBot 4,200件
ClaudeBot 1,800件
PerplexityBot 980件
Google-Extended 540件

同じ調査では、GPTBot がよく見られているページを平均2.4日ごとに再訪問するのに対し、ClaudeBot は平均6.8日ごととされています。

なお、AI検索経由の訪問数について、2025年Q1の156億件から2026年Q1の274億件へ増えたという数字もあります(Contently)。出典は「42.8%増」と書いていますが、示されているこの2つの数字からは75.6%増になります。どちらが正しいかはこの記事では確かめられないので、数字だけを引きます。

※ いずれも海外サイトを対象にした調査です。日本語サイトで同じになるかは確かめていません。Cloudflareの調査は2025年10〜11月のもので、この記事を更新した時点から10か月前になります。

どのBotが来ても読める形にする

ここまでを並べると、Botごとに設定を変えて扱いを決めるのは難しい、ということになります。Amazonの例では、99個のBotを断っても、AIによって扱いは違いました(Amazonが生成AIのボットをブロックしているのを、知っていますか?)。Botの種類によって動くタイミングは違いますが、渡しているHTMLは1つです。

4種類のBotが読みに来るのは、同じ1つのHTML インデックス型・学習型・代理アクセス型・従来の検索エンジンの4種類は、動くタイミングは違うが、読みに来るのは同じページのHTMLである。各社の公式ドキュメントが挙げている観点は、見出しと本文の対応、定義と結論の位置、出典と著者の明示、JavaScriptに頼らない本文の4つ。 動くタイミングは違う ① インデックス型 ② 学習型 ③ 代理アクセス型 【土台】従来の検索エンジン 読みに来るのは同じHTML 1つのページのHTML ・見出しと、その答えの本文が対応しているか ・定義と結論が、どこに置かれているか ・出典と著者が書かれているか ・JavaScriptに頼らず本文が読めるか ※ 各社の公式ドキュメントが挙げている観点。引用されやすさが変わるかは確かめていません
図3:4種類のBotが読みに来るのは、同じ1つのHTML
右側の4項目は、各社の公式ドキュメントが引用や理解の観点として挙げているものです。これらを直すと引用が増えるかどうかは、別の話です

Botの分類を知る使い道は、「どのBotに何をするか」を決めることではなく、「いま自分のページは、どのタイミングで、誰に読まれうるのか」を把握することだと考えています。

この記事で確かめたこと、確かめていないこと

この記事のうち、自社で確かめたことと、確かめていないことを分けておきます。

確かめたこと

  • robots.txt で99個のBotを断っていた amazon.co.jp を、ChatGPTは108回答中41回答で出典にしていた(Geminiは151回答中0回答)

確かめていないこと

  • 日本語サイトへの、Botごとの来訪頻度
  • Botが来てから、AIの回答に出るまでの時間
  • FAQの形にすると、引用されやすくなるかどうか
  • 見出しの構造を直すと、AIの扱いが変わるかどうか
  • Botごとに、引用されるページの中身が違うかどうか

確かめたものが出たときに、この節に足します。

よくある質問

Q AIごとに対策を分ける必要はありますか?

A

Botの役割はAIごとに違いますが、設定で分けたとおりに扱われるとは限りませんでした。99個のBotを断っていた amazon.co.jp を、ChatGPTは108回答中41回答で出典にしています。読みに来るのはどのBotも同じHTMLなので、分けるより、どのBotが来ても読める形にするほうが確実だと考えています。

Q robots.txt でBotをブロックすべきですか?

A

公式の説明では、学習用のBot(GPTBot・ClaudeBot)と検索用のBot(OAI-SearchBot・PerplexityBot)は別のものとして扱われています。ただし、断ったとおりに扱われるとは限りません。amazon.co.jp は99個のBotを断っていましたが、ChatGPTは出典にしていました。設定を変えるなら、変えたあとに実際のAIの回答を見て確かめることをおすすめします。

Q PerplexityBot は Googlebot や Bingbot と何が違いますか?

A

Googlebot や Bingbot は従来の検索エンジンのためのBotで、ユーザーに検索結果のリンクを返します。PerplexityBot はAIの回答を作るための情報収集を行い、回答の中に引用URLとして表示されます。なお到達しているページ数には大きな差があり、Cloudflareの調査(2025年10〜11月)では Googlebot が11.6%、PerplexityBot が0.06%でした。

参照・出典

この記事を書いた人

吉田 清登 / Yoshida Kiyoto

株式会社FID 執行役員CMO / Genview プロダクトマネージャー / JECCICA客員講師

通販業界20年以上。再春館製薬所で越境EC・タイチームの管理を経て、現在は Genview の事業責任者。

得意分野のCRMのエッセンスをGEO対策に取り入れたのが Genview です。AI時代の接客は BtoC with AI。主役はお客様で、AIはその間に入った存在です。お客様に伝えると同時に、AIにも自社を正しく伝える。AIを通してどう伝わっているかを、実際に測って確かめています。

専門領域:GEO対策 / CRM・顧客コミュニケーション / 越境EC

プロフィール / note

あわせて読む

Genview のご案内

AIでの見え方を測りたい方は、Genview をお使いください。

測った結果から、どの質問で何を直すかまで知りたい方には、コンサルプラン(戦略策定・改善提案・運営代行)をご用意しています。

GEO・AI検索のご相談。自社サイトの構造や情報設計、無料で相談してみませんか? 無料相談はこちら