robots.txtで​AIの​読み取りを​拒否すべきか。​学習用と​検索用を​分けて​考える

AIの​学習を​断ろうと​robots.txtで​読み取りを​止めると、​止め方次第で​AIの​回答に​自社が​出る​道まで​閉ざします。​学習用と​検索用の​プログラムの​違いと、​目的ごとの​設定の​考え方を、​各社の​公式情報を​もとに​整理します。

この​記事の​結論

AIの​提供会社の​多くは、​サイトを​読みに​来る​プログラムを​「AIの​学習に​使う​もの」と​「検索や​回答に​使う​もの」に​分けています。​学習だけを​断りたいなら、​robots.txtで​止めるのは​学習用の​プログラムだけに​します。​検索用まで​止めると、​ChatGPTの​検索の​答えなどに​自社が​出なくなります。​まずは​自社の​ robots.txt を​開き、​意図しない​拒否が​ないかを​確かめる​ところから​始めます。

robots.txtとは

robots.txtは、​サイトの​一番上に​置く​小さな​テキストファイルです。​検索エンジンや​AIの​プログラムに​対して、​「この​サイトの​この​部分は​読んでいい」​「ここは​読まないで」と​伝えます。​https://自社のドメイン/robots.txt を​ブラウザで​開くと、​中身を​確かめられます。

ここで​気を​つけたいのは、​AIの​提供会社が、​目的ごとに​別々の​プログラムを​持っている​ことです。​どの​プログラムを​止めるかで、​結果が​大きく​変わります。

学習用と、​検索・回答用の​違い

主な​AIの​提供会社は、​次のように​読み取りの​プログラムを​分けています。

提供会社検索・回答に​使うAIの​学習に​使う出典
OpenAI(ChatGPT)OAI-SearchBot:拒否すると、​ChatGPTの​検索の​答えに​表示されなくなるGPTBot:拒否しても、​検索の​答えでの​表示には​影響しないOpenAI:クローラーの​説明
Google通常の​ Googlebot​(AI Overview⁠・⁠AIモードは​Google検索の​仕組みを​使う)Google-Extended:拒否しても、​Google検索への​登録や​順位には​影響しないGoogle:一般的な​クローラー
PerplexityPerplexityBot:検索結果に​サイトを​表示し、​リンクする​ために​使う学習用には​使わないと​明記Perplexity:クローラーの​説明

OpenAIには、​ほかに​ ChatGPT-User という​プログラムも​あります。​利用者が​ChatGPTで​質問した​ときに、​その​場で​ページを​見に​行く​ための​もので、​検索の​答えに​表示されるか​どうかの​判断には​使わないとされています。

白い資料と無地の鍵を分けて置き、読み取りの範囲を考える様子
白い​資料と​無地の​鍵を​分けて​置き、​読み取りの​範囲を​考える​様子

目的ごとの、​考え方

学習には​使われたくないが、​AIの​回答には​出たい

多くの​会社に​とって、​いちばん現実的な​考え方です。​止めるのは​学習用の​プログラムだけに​して、​検索・回答用は​止めません。

  • 止める​:GPTBot、​Google-Extended など​学習用
  • 止めない​:OAI-SearchBot、​Googlebot、​PerplexityBot など​検索・回答用

AIの​回答に​出る​ことを​優先したい

問い合わせを​増やすために、​AIの​回答で​紹介されたい​会社は、​検索・回答用の​プログラムを​止めない​ことが​大前提です。​学習用を​止めるか​どうかは、​会社の​考え方で​決めます。

AIに​一切​関わりたくない

すべてを​止める​こともできます。​ただし、​その​場合は​AIの​回答で​自社が​紹介される​機会も​手放すことになります。​Google検索​その​もの​(Googlebot)まで​止めると、​通常の​検索結果にも​出なくなるので、​ここは​止めません。

やりがちな​失敗

  • 「AIを​止める」つもりで、​検索用まで​止めている。 ChatGPTの​検索の​答えなどに、​自社が​出なくなります
  • 自社で​設定した​覚えが​ないのに、​止まっている。 制作会社の​設定や、​セキュリティの​サービスが、​まとめて​AIの​読み取りを​止めている​ことがあります
  • robots.txtで、​Google検索まで​止めている。 公開前の​確認用の​設定が、​そのまま​本番に​残っている​ことがあります。​Disallow: / が​全体に​かかっていないか​確かめます

robots.txtの​設定は、​1行の​違いで​大きく​結果が​変わります。​書き換えたら、​ブラウザで​開いて​中身を​確かめ、​Google Search Consoleなどで、​意図しない​拒否に​なっていないかも​確認します。

まず、​自社の​ robots.txt を​確かめる

  1. ブラウザで​ https://自社のドメイン/robots.txt を​開く
  2. User-agent: の​行に、​どの​プログラムの​名前が​書かれているかを​見る
  3. その​下の​ Disallow: で、​何を​止めているかを​見る
  4. 検索・回答用の​プログラム​(OAI-SearchBot、​Googlebot、​PerplexityBot)が​止まっていないかを​確かめる

robots.txtが​置かれていない​場合は、​すべての​プログラムに​読み取りを​許している​状態です。​AIの​回答に​出る​ことを​優先するなら、​それで​問題は​ありません。​AIに​紹介される​ための​取り組みの​全体は、ChatGPTに​自社を​紹介して​もらうにはとLLMOとは?に​まとめています。

私たちの​サイトで、​各社の​プログラムを​名乗って​確かめた​結果

bundlyzeの​サイトでは、​学習用・検索用ともに、​AIの​プログラムを​止めていません。​AIの​答えで​自社を​紹介して​もらう​ことを​優先している​ためです。

robots.txt を​読むだけでは、​本当に​読める​状態かまでは​分かりません。​そこで​2026年10月1日に、​各社の​プログラムの​名前を​名乗って、​自社の​コラムの​ページを​取得してみました。

名乗った​プログラム提供会社結果
OAI-SearchBotOpenAI​(検索)200​(正常に​読めた)
ChatGPT-UserOpenAI​(利用者の​質問で​見に​行く)200
GPTBotOpenAI​(学習)200
PerplexityBotPerplexity200
ClaudeBotAnthropic200
bingbotMicrosoft(Bing)200
GooglebotGoogle200

同じ​確かめ方を、​自社でする​手順

Macの​「ターミナル」で、​次の​1行を​実行します。​Windowsの​「PowerShell」では、​先頭の​ curl を​ curl.exe に、​/dev/null を​ NUL に​置き換えます。​-A の​後ろには、​確かめたい​プログラムの​名前を​含む文字列を​入れ、​最後に​自社の​ページの​URLを​入れます。

curl -A "OAI-SearchBot" -o /dev/null -w "%{http_code}" https://自社のドメイン/

画面に​出る​3桁の​数字で、​結果を​読みます。

数字意味
200正常に​読めた
301、302別の​URLに​案内された。​案内先の​URLで、​もう​一度​確かめる
403読み取りを​断られた。​サーバーや​セキュリティの​サービスが​止めている​可能性が​ある
404ページが​見つからない。​URLの​書き間違いを​確かめる

プログラムの​名前を​1つずつ​入れ替えて、​検索・回答用の​ものが​すべて​200に​なるかを​見ます。

この​方法は、​名前を​「名乗る」だけの​確認です。​本物の​プログラムは、​各社が​決めた​場所​(IPアドレス)から​読みに​来るので、​ファイアウォールなどが​その​場所からの​読み取りを​止めている​場合は、​この​方法では​分かりません。​セキュリティの​サービスを​使っている​場合は、​その​設定画面で、​AIの​プログラムを​止める​機能が​有効に​なっていないかも​あわせて​確かめます。

AIに​紹介される​ための​取り組みを、​自社サイトで​どう​進めているかは、bundlyzeの​LLMO⁠・⁠SEO実践記録で​公開しています。​AI向けの​案内の​ファイルを​置くかどうかは、llms.txtとは。​作り方と​確認方法で​整理しています。

よく​ある​質問

robots.txtで​止めれば、​AIに​学習されないと​言い​切れますか?
robots.txtは、​読み取りの​プログラムに​向けた​「お願い」の​仕組みです。​主な​提供会社は、​自社の​プログラムが​robots.txtに​従うと​説明していますが、​すべての​プログラムが​従う​保証は​ありません。
robots.txtを​置いていないと、​何か​困りますか?
置いていない​場合は、​すべての​プログラムに​読み取りを​許している​状態に​なります。​読ませたくない​ページが​なければ、​困る​ことは​ありません。
新しい​AIの​プログラムが​出てきたら、​どうすればいいですか?
提供会社の​公式の​説明で、​その​プログラムが​学習用か​検索・回答用かを​確かめてから、​止めるか​どうかを​決めます。​名前だけで​判断して、​まとめて​止めるのは​避けます。

止めるのは、​学習用だけで​十分な​ことが​多い

AIの​読み取りを​止めるか​どうかは、​会社の​考え方で​決めて​よい​ことです。​ただ、​学習用と​検索・回答用を​区別せずに​止めると、​AIの​回答で​紹介される​機会まで​失います。​止めるなら、​どの​プログラムを​止めるのかを​1つずつ​確かめる。​それだけで、​意図しない​損を​防げます。

まずは​今日、​自社の​ robots.txt を​開いて、​中身を​確かめてみてください。

ご相談

検索や​AIでの​見つかり方に​ついて、​いまの​状況を​お聞かせ​ください。

「何から​手を​つければいいか​分からない」という​段階からで​構いません。​返信は​担当者が​直接お送りします。

送信いただいた個人情報はプライバシーポリシーに基づき取り扱います。