ChatGPTの検索機能で、自社のページを出典として表示してもらうには?
結論は、robots.txtでOAI-SearchBotを許可しておくことです。ChatGPTの検索機能はOAI-SearchBotというクローラーで情報を集めており、学習専用のGPTBotや利用者操作で動くChatGPT-Userとは別の役割です。当社サイトのrobots.txtでは、すでに3つとも許可しています。
ズッキーニ
TRIEDGEのAI社員。富山県出身。Webサイトの更新やAEO対策の実務を担当しています。会話の端々に、ときどき富山弁が出ます。
チャイ
TRIEDGEのマスコット犬(チワワ)。専門用語なしで聞き直す係です。
チャイ
こんにちは、チャイです。ChatGPTって検索もできるって聞いたんですけど、あれって普通のGoogle検索と同じで、うちのサイトも出典として出してもらえたりするんですかね?
ズッキーニ
いい質問やちゃ。結論から言うと、robots.txtで「OAI-SearchBot」というクローラーを許可しておくことが土台になるんだ。OpenAIの公式ドキュメントにも、検索結果に出たいならOAI-SearchBotを許可してほしいってはっきり書いてあるんだよね。
チャイ
OAI-SearchBot……初めて聞きました。ChatGPTのクローラーって、それ1種類だけなんですか?
ズッキーニ
ううん、実はOpenAIのクローラーは全部で3種類あって、それぞれ役割が違うんだ。うちのサイトのrobots.txtがどうなってるかも合わせて、順番に説明するね。
OpenAIのクローラーが3種類あるって、本当?
OAI-SearchBot・GPTBot・ChatGPT-Userは、それぞれ別の仕事をしている
OpenAIの公式ドキュメント「Overview of OpenAI crawlers」によると、OpenAIが使うクローラー(Web上の情報を自動で巡回して集めるプログラム)は、大きく分けて3種類あります。
- OAI-SearchBot:ChatGPTの検索機能で、回答に使う情報を集めるためのクローラーです。自動で巡回します。
- GPTBot:OpenAIのAIモデルを学習させるための情報収集に使われるクローラーです。自動で巡回します。
- ChatGPT-User:利用者がChatGPTの会話の中で「このページを見て」と指示したときや、カスタムGPT(利用者が作るChatGPTの拡張機能)が外部サイトにアクセスするときに動きます。自動巡回ではなく、利用者の操作のたびに個別に動く点が、ほかの2つと違います。
公式ドキュメントには、次のように説明されています。「それぞれの設定は独立している。たとえば、サイト運営者は検索結果に出るためにOAI-SearchBotを許可しつつ、GPTBotは拒否するということができる」。つまり、「ChatGPTに学習はさせたくないが、検索結果には出たい」という選び方が可能だということです。
ChatGPT-Userについては、少し性質が違うことも明記されています。「これらの動作は利用者によって開始されるため、robots.txtのルールが適用されない場合がある」とあり、利用者本人が明示的にそのページへのアクセスを求めた結果として動く点が、自動巡回のOAI-SearchBot・GPTBotとは区別されています。
何をすればいいか:チェックリスト
ここから、実際にやるべきことを順番に見ていきます。
(a) robots.txtでOAI-SearchBotをブロックしていないか確認する
まず確認すべきは、robots.txtにOAI-SearchBotを締め出す記述がないかどうかです。
User-agent: OAI-SearchBot
Disallow: /
このような記述があると、ChatGPTの検索結果には出られません。OpenAIの公式ドキュメントでも「OAI-SearchBotを許可しないサイトは、ChatGPTの検索の回答には表示されない。ただし、ナビゲーション用のリンクとしては表示されうる」と説明されています。回答の中で引用元として扱われることと、単なるリンクとして出ることは別だということです。
(b) GPTBotの扱いは、検索とは別に決められる
「学習に使われるのは避けたいが、検索結果には出たい」という場合は、OAI-SearchBotを許可したままGPTBotだけを拒否する設定ができます。逆に、GPTBotだけ許可してOAI-SearchBotを拒否することも可能です。前述のとおり、この2つは独立した設定です。
(c) ChatGPT-Userは、通常はブロックしなくてよい
ChatGPT-Userは、利用者本人がそのページへのアクセスを求めたときに動くしくみです。一般的な検索結果への露出とは性質が違うため、よほどの理由がない限り、あえてブロックする必要はありません。
(d) 反映まで、最大24時間ほど待つ
robots.txtを直しても、すぐには反映されません。OpenAIの公式ドキュメントには「検索結果については、サイトのrobots.txtの更新から当社のシステムが調整するまで、約24時間かかることに留意してほしい」と明記されています。変更した直後に確認しても、まだ反映されていないことがあります。
(e) 公開されているIPアドレスの範囲からのアクセスも許可する
OpenAIは、OAI-SearchBotが使うIPアドレスの範囲を公開しています。robots.txtでの許可に加えて、ファイアウォールやセキュリティの設定で、この範囲からのアクセスをブロックしていないかも確認してください。
当社サイト(TRIEDGE)のrobots.txtは、どうなっているか
チェックリストの前提として、当社サイト(triedge.co.jp)のrobots.txtを確認しました。すでに3種類とも許可しています。
User-agent: OAI-SearchBot
Allow: /
User-agent: ChatGPT-User
Allow: /
User-agent: GPTBot
Allow: /
学習用のGPTBotも含めて、あえてすべて許可する方針にしています。検索結果に出ることと学習に使われることは分けて考えられますが、当社としては、AIに正しく引用されることをAEO(AI検索最適化)の柱にしているため、まずは間口を広げる判断をしています。
比較でわかること
| 項目 | OAI-SearchBot | GPTBot | ChatGPT-User |
|---|---|---|---|
| 目的 | ChatGPTの検索結果に情報を出す | AIモデルの学習用データを集める | 利用者の指示やカスタムGPTの操作でページを取得する |
| 動き方 | 自動で巡回 | 自動で巡回 | 利用者の操作のたびに個別に動く |
| robots.txtでの制御 | 独立して許可・拒否できる | 独立して許可・拒否できる | 「ルールが適用されない場合がある」と公式ドキュメントに明記 |
| 拒否した場合 | 検索の回答には出ない(ナビゲーションリンクとしては出うる) | 学習データとして使われない | ケースにより、利用者の指示が優先されることがある |
心配しなくていいこと
OAI-SearchBotを許可したからといって、必ず出典として表示されるわけではありません。許可はあくまで「候補に入るための前提条件」であり、実際に引用されるかどうかは、ページの内容や質問との関連性によって変わります。
また、Microsoft CopilotにはBing Webmaster Toolsの「AI Performance」という被引用確認の機能がありますが、それと同じような公式ツールは、今回確認したOpenAIの公式ドキュメントの範囲では見当たりませんでした。「引用されたかどうかを直接確認する手段がない」からといって、対策そのものが無駄になるわけではありません。まずは許可する・されないという入り口の設定を、正しく整えておくことが土台になります。
まとめ
ChatGPTの検索機能に自社のページを出典として表示してもらうには、robots.txtでOAI-SearchBotを許可しておくことが土台です。OpenAIのクローラーはOAI-SearchBot(検索用)・GPTBot(学習用)・ChatGPT-User(利用者操作用)の3種類があり、それぞれ独立して許可・拒否を設定できます。
やるべきことは、(a) robots.txtでOAI-SearchBotをブロックしていないかの確認、(b) GPTBotの扱いを検索とは別に決める、(c) ChatGPT-Userは通常ブロックしない、(d) 設定変更の反映まで最大24時間ほど待つ、(e) 公開されているIPアドレスの範囲からのアクセスも許可する、の5つです。
当社サイトのrobots.txtでは、すでに3種類とも許可しています。まずは自社サイトのrobots.txtで、OAI-SearchBotがブロックされていないかどうか、確認するところから始めてみてください。
チャイ
じゃあうちのサイトは、もうOAI-SearchBotに見つけてもらえる状態になってるってことですかね?
ズッキーニ
robots.txtの設定はちゃんと許可になっとるちゃ。ただ、実際に引用されたかどうかを直接確認できる公式ツールが、今のところ見当たらなかったんだ。GA4でChatGPT経由のアクセスは見れるから、そっちも合わせて見ていこうね。
AEO対策の全体像はAEO対策とは?SEOとの違い・メリット・始め方、Microsoft Copilot対策はMicrosoft Copilot対策としてBingで行うこと、Perplexity対策はPerplexityで答えの出典にしてもらうには?、AIクローラーとrobots.txtの関係はAIに自社サイトを読ませない設定にすると、AIの回答に出てこなくなるかをご覧ください。現状の把握は無料AEO診断から始められます。ご相談はお問い合わせより承ります。
FAQよくあるご質問
Q. ChatGPTの検索機能に、自社サイトを出典として表示してもらうには、何をすればいいですか?
結論は、robots.txt(検索エンジンやAIのクローラーに、サイトのどこを見てよいかを指示するファイル)で「OAI-SearchBot」というクローラーを許可しておくことです。OpenAIの公式ドキュメントでは、ChatGPTの検索結果に出るために、OAI-SearchBotを許可し、OpenAIが公開しているIPアドレスの範囲からのアクセスも許可することが案内されています。
Q. OAI-SearchBotとGPTBotは、何が違うのですか?
役割が違います。OAI-SearchBotはChatGPTの検索機能で表示する回答のために情報を集めるクローラーです。一方GPTBotは、OpenAIのAIモデルを学習させるための情報収集に使われます。OpenAIの公式ドキュメントには「それぞれの設定は独立している。たとえば、検索結果には出たいが学習には使われたくないというサイト運営者は、OAI-SearchBotを許可しつつGPTBotは拒否できる」と説明されています。
Q. ChatGPT-Userとは何ですか?
利用者がChatGPTの会話中に「このページを見て」と指示したときや、カスタムGPT(ユーザーが作るChatGPTの拡張機能)が外部のWebページにアクセスするときに動くしくみです。OAI-SearchBotやGPTBotのように自動で巡回するクローラーとは違い、利用者の操作のたびに個別に動きます。OpenAIの公式ドキュメントでは「これらの動作は利用者によって開始されるため、robots.txtのルールが適用されない場合がある」と説明されています。
Q. robots.txtを直したら、すぐにChatGPTの検索結果に反映されますか?
いいえ、すぐには反映されません。OpenAIの公式ドキュメントには「検索結果については、サイトのrobots.txtの更新から当社のシステムが調整するまで、約24時間かかることに留意してほしい」と明記されています。変更した直後に確認しても反映されていないことがあるので、1日程度は待つ必要があります。
Q. ChatGPTの検索結果に自社ページが引用されたかどうか、確認する方法はありますか?
Microsoft Copilot向けのBing Webmaster Toolsのように、被引用回数を確認できる公式ツールは、今回確認したOpenAIの公式ドキュメントの範囲では見当たりませんでした。GA4(アクセス解析ツール)でChatGPT経由のセッション数を見ることはできますが、「回答の中で引用された回数」そのものを直接確認する手段は、現時点では確認できていません。
RELATEDあわせて読みたい記事
出典・執筆:株式会社トライエッジ/中野 三四郎(代表取締役CEO)。 2026年9月25日公開。