【2026最新】AIクローラーとrobots.txt|何を許可し何を止めるか

重要なポイント

AIクローラーの種類とrobots.txtでの制御方法を解説。Google-ExtendedがAI検索を制御しない理由と、許可・ブロックの判断基準を整理します。

【2026最新】AIクローラーとrobots.txt|何を許可し何を止めるか

結論から書きます。AIクローラーを止めると、AI検索からも外れます。 そしてGoogle-Extendedをブロックしても、Google検索のAI機能からは外れません。この2つは別の仕組みです。

この記事では、AIクローラーの種類、robots.txtでの制御方法、そして止めるべきかどうかの判断を整理します。

まず押さえるべき区別

混同しやすい3つの概念を分けます。

概念

何を制御するか

Googlebot

Google検索のクロール

Google-Extended

Gemini のアプリ/Vertex AI でのコンテンツ利用

AI検索の回答

Google検索のAI機能(AI Overviews等)

重要:Google-ExtendedはGoogle検索のAI機能を制御するものではありません。

出典:Google Search Central「Google common crawlers」(2026年9月23日確認)

主なAI関連クローラー

クローラー

運営

用途

Googlebot

Google

Google検索のクロール

Google-Extended

Google

Gemini アプリ/Vertex AI での利用

GPTBot

OpenAI

モデルの学習・改善

OAI-SearchBot

OpenAI

ChatGPTの検索機能

ChatGPT-User

OpenAI

ユーザー操作によるアクセス

ClaudeBot

Anthropic

モデルの学習

PerplexityBot

Perplexity

検索インデックス

注意:同じ運営元でも、学習用と検索用は別のクローラーです。片方を止めると、もう片方に影響が出る場合があります。

判断の分岐

クローラー種別ごとの判断表

学習用・検索用・Google-Extendedで扱いが異なる

「止めるかどうか」は目的によって変わります。

止めたくない場合(推奨)

AI検索から流入を得たい場合は、検索系のクローラーを許可します。

目的

許可するクローラー

Google検索のAI機能に掲載されたい

Googlebot

ChatGPTの検索に掲載されたい

OAI-SearchBot

Perplexityに掲載されたい

PerplexityBot

AI検索の回答に使われるには、クロールが前提条件です。

止めたい場合

コンテンツを学習に使わせたくない場合は、学習系のクローラーを止めます。

目的

止めるクローラー

モデル学習に使わせたくない

GPTBot、ClaudeBot

Gemini アプリでの利用を止めたい

Google-Extended

重要:学習を止めても、検索からの掲載は維持できます。 学習用と検索用が分かれているためです。

robots.txtでの制御方法

特定のクローラーを止める

Code
User-agent: GPTBot
Disallow: /

期待される結果:GPTBotがサイト全体をクロールしなくなります。

検索用は許可し、学習用だけ止める

Code
User-agent: GPTBot
Disallow: /

User-agent: OAI-SearchBot
Allow: /

期待される結果:ChatGPTの検索には掲載され、学習には使われません。

Google-Extendedを止める

Code
User-agent: Google-Extended
Disallow: /

期待される結果:Gemini アプリ/Vertex AI での利用が止まります。

重要:Google検索のAI機能には影響しません。 Google-Extendedは別の仕組みです。

手順:現状を確認する

手順1:robots.txtを確認する

  1. https://(ドメイン)/robots.txt を開きます
  2. AI関連のクローラーが指定されているか確認します

期待される結果:現在の指定状況が分かります。

手順2:意図しないブロックを探す

最も多い事故は、意図せずブロックしているケースです。

確認項目

内容

Disallow: / が全体に指定されていないか

全クローラーを止めていないか

User-agent: * の指定

ワイルドカードで止めていないか

ステージング環境の設定が本番に残っていないか

よくある事故

品質チェック:Googlebotがブロックされていないかを必ず確認してください。ブロックされていると、検索からも外れます。

手順3:サーチコンソールで確認する

  1. サーチコンソールを開きます
  2. 「設定」→「robots.txt」を確認します
  3. クロール統計を確認します

期待される結果:Googlebotのアクセス状況が確認できます。

よくある誤解

誤解1:Google-Extendedを止めればAI検索から外れる

外れません。 Google-ExtendedはGemini アプリ/Vertex AI での利用を制御するもので、Google検索のAI機能とは別です。

誤解2:AIクローラーを全部止めれば安全

AI検索からの流入も失います。 検索系のクローラーを止めると、回答に掲載されなくなります。

誤解3:robots.txtで完全に防げる

robots.txtは指示であり、強制力はありません。 遵守しないクローラーもあります。

確実に防ぎたい場合は、サーバー側での制御を検討してください。

誤解4:止めれば学習されない

robots.txtを無視するクローラーには効果がありません。 また、すでに学習された内容は取り消せません。

誤解5:AI検索用に特別な許可設定が必要

必要ありません。 Googleは、AI検索に追加の技術要件はないと説明しています。

出典:Google Search Central「AI features and your website」(2026年9月23日確認)

判断のまとめ

やりたいこと

設定

AI検索からの流入を得たい

検索系クローラーを許可

学習に使わせたくない

学習系クローラーをブロック

Gemini アプリでの利用を止めたい

Google-Extendedをブロック

Google検索のAI機能を止めたい

Google-Extendedでは実現できない

すべてのAIから外れたい

各クローラーを個別にブロック

よくある質問

AIクローラーは止めるべきですか?

目的によります。 AI検索からの流入を得たいなら許可してください。学習に使わせたくないなら、学習系のみをブロックします。

Google-Extendedをブロックするとどうなりますか?

Google検索のAI機能には影響しません。 Gemini アプリ/Vertex AI での利用が止まります。

検索用と学習用は分けられますか?

分けられます。 OpenAIはGPTBot(学習)とOAI-SearchBot(検索)を別々に提供しています。

robots.txtで確実に防げますか?

確実ではありません。 robots.txtは指示であり、強制力はありません。確実に防ぐにはサーバー側の制御が必要です。

ブロックすると検索順位が下がりますか?

Googlebotをブロックすると、検索から外れます。 学習系クローラーのブロックは検索順位に影響しません。

AI検索用の特別な設定は必要ですか?

必要ありません。 Googleは、AI検索に追加の技術要件はないと説明しています。

まとめ

  • Google-ExtendedはGoogle検索のAI機能を制御しない
  • 学習用と検索用は別のクローラー
  • AI検索からの流入を得たいなら検索系を許可
  • 学習に使わせたくないなら学習系をブロック
  • robots.txtは強制力がない
  • Googlebotをブロックすると検索から外れる

まず現在のrobots.txtを確認し、意図しないブロックがないかをチェックしてください。

Author: Gabriel Finch、Auspia。1,200以上のAI回答を検証する検索取得リサーチャー。検索インフラ、取得システム、AIディスカバリーを執筆。

このトピックを読む

同じテーマの記事を続けて読む