「検索には載ったまま、AI学習だけ断る」設定、Cloudflareが全プラン無料で提供。Google・Appleのボットに適用

Style ← お好みの文体を選べます。選択は自動で記憶されます

「検索には載ったまま、AI学習だけ断る」設定、Cloudflareが全プラン無料で提供。Google・Appleのボットに適用【2026年9月】

「検索には載ったまま、AI学習だけ断る」設定、Cloudflareが全プラン無料で提供。Google・Appleのボットに適用 インフォグラフ

米Cloudflareが、Webサイトを検索結果に残したまま、AIの学習に使われることだけを断れる設定「Disallow AI Training」を発表しました。無料を含む全プランの全顧客に提供されます (現地時間2026年9月15日(火)・同社プレスリリースと公式ブログ)。背景にあるのは、検索の索引づくりとAIの学習データ集めを同じボットで行う「混合用途クローラー」で、Cloudflare上の認証済みクローラー (Cloudflareに身元を登録した正規のボット) の通信量の36.6%を占める、と同社は説明しています。

これまでサイトの運営者は、学習を断ろうとすると検索の巡回まで断ることになり、検索に出たければ学習も許すしかない、という二択を抱えていました。今回の設定はその二択をほどくもので、GoogleとAppleは学習専用のボット名を指定して断れ、Microsoftはrobots.txt (サイトの入口に置く小さなテキストで、どのクローラーに何を許すかを書く) への対応を2027年初頭の目標としています。数字と各社の時期を、発表の範囲で確かめます。

この記事のポイント

  • Cloudflareが「Disallow AI Training」設定を発表。検索結果に残ったままAI学習だけを拒否でき、無料を含む全プラン・全顧客が対象 (現地時間2026年9月15日(火))
  • 混合用途クローラーは認証済みクローラー通信の36.6%。検索と学習を一台で兼ねるため、片方を断ると両方を断ることになっていた (同社発表)
  • 検索ボットを遮断するサイトは1%未満、AI学習を何らかの方法で制限するサイトは17% (Cloudflare経由のサイトの統計)
  • GoogleとAppleは学習用の名前 (Google-Extended / Applebot-Extended) への拒否が効く。URL単位の可視化ツールはGoogleが数週間以内、Appleが来年。Microsoftはrobots.txt対応を2027年初頭目標
  • 既存顧客の設定はそのまま。新規ドメインには広告の有無で2種類の既定値が入る

何が起きたのか

Cloudflareは、Webサイトの手前に立って通信を中継する会社です。同社を通るサイトの運営者は、管理画面で「Disallow AI Training」を有効にすると、検索エンジンのクローラー (Webページを自動で巡回して読む仕組み。検索の索引づくりやAIの学習データ集めに使われる) には従来どおりページを読ませつつ、AIの学習に使う目的での読み取りだけを断れます。

仕組みの中身は、robots.txtの代筆です。GoogleとAppleは、検索用のボットとは別に、Google-Extended / Applebot-Extended (GoogleとAppleが用意するAI学習用のボット名) を以前から用意しています。Cloudflareは、この名前への拒否を運営者に代わってまとめて設定します。

同社CEOのMatthew Prince氏はプレスリリースで、検索を価値あるものにしている開放性を保ちながら、Webの背後にいる人と企業に、自分の仕事がどう使われるかについての実質的な制御を渡す、という趣旨を述べています。

検索と学習を一台で兼ねる「混合用途クローラー」が36.6%

混合用途クローラー (検索の索引づくりとAIの学習データ集めを一つのボットで兼ねる運用。片方だけ断ることができなかった) は、Cloudflare上の認証済みクローラーの通信量の36.6%を占める、と同社はプレスリリースで説明しています。検索に出るための巡回と、学習のための読み取りが一台のボットに同居していて、片方だけを断る書き方がありませんでした。

運営者の側の現状も、同社のブログに数字があります。検索ボットを遮断しているサイトは1%未満、AI学習を何らかの方法で制限しているサイトは17%です。検索の入口を閉じるサイトはごく少なく、学習を制限しているサイトが一定数あります。

同社のブログによると、OpenAI・Anthropic・Meta・Amazonは検索用と学習用のクローラーが分かれているため、この設定はそれらの学習用ボットだけを遮断する形になります (ITmedia AI+ 2026年9月17日(木) も同旨)。混合用途にあたるのは、Apple・Google・Microsoftの型です。

Apple・Google・Microsoft、それぞれの段階

Cloudflareは、混合用途クローラーの運営者に「説明責任がある (Accountable)」と呼べる条件を4つ挙げています。(1) robots.txtなどでAI学習をオプトアウトできること、(2) 検索結果の上に出るAI要約からのオプトアウトを運営者と直接設定できること、(3) どのページが学習に使われたかのURL単位の可視性と、検索での表示指標、(4) 学習のオプトアウトが従来の検索結果に影響しないという保証、の4点です。

同社のブログによる3社の状況は次のとおりです。Appleは、Applebot-Extendedへの拒否で学習を断れ、検索順位に影響しないと明言しており、URL単位の可視化は来年の予定です。Googleは、Google-Extendedのrobots.txtオプトアウトが使え、こちらも検索順位に影響しないと明言しており、URL単位の透明性ツールは数週間以内に出すとしています。Microsoftは現在NOARCHIVEメタタグ (robots.txtがサイトの入口に置く指示なのに対し、ページごとに書く指示) での指定で、robots.txt対応は2027年初頭が目標です。

Cloudflareが「説明責任がある」と呼んだのは、各社が4条件を満たしたこと、または満たす時期を約束したことです。3社そろって完了した段階ではありません。

既定値と、既存サイトの扱い

新規ドメインには、広告の有無で2種類のプリセットが入ります。広告のあるサイトは「検索は許可・AI学習は拒否・広告ページへのAIエージェント (人の代わりにページを操作する自動プログラム) は遮断」、広告のないサイトは「すべて許可」です。既存顧客の設定はそのまま引き継がれる、と同社は書いています。

数字の読み方 (Cloudflare経由の統計と、お願いとしてのrobots.txt)

36.6%、1%未満、17%は、いずれもCloudflareを通るサイトとクローラーの統計で、Web全体の比率とは別のものです。同社は世界の多くのサイトの手前に立っていますが、日本の個人サイトや企業サイトの実態をそのまま示す数字として読むと、ずれが出ます。

もう一つ、この設定が書いているのはrobots.txtの「お願い」です。学習に使わないでほしい、という意思表示を機械が読める形で置くもので、新しい法律や規制ができた話とは別です。守るかどうかはクローラーの側に委ねられており、無視するクローラーには効きません。Cloudflareには認証済みクローラーの識別や遮断の仕組みが別にありますが、robots.txt自体に強制力はない、という前提は今回も同じです。

日本の読者にとっての意味

個人ブログや会社のサイトを持っている人なら、robots.txtに2行を足すだけで、同じ意思表示ができます。Google-ExtendedとApplebot-ExtendedのそれぞれにDisallowを書けば、検索用のGooglebotやApplebotには従来どおり読ませたまま、AI学習用の読み取りだけを断る形になります。Cloudflareを使っていないサイトでも書けるもので、Cloudflareがしているのは、この記述の代筆と一括化です。

書く前に押さえておきたいのは、この2行がお願いであることと、効く相手が限られることです。GoogleとAppleは名前を分けているので2行が意味を持ちますが、Microsoftのrobots.txt対応は2027年初頭が目標で、それまではNOARCHIVEメタタグでの指定になります。検索順位への影響については、GoogleとAppleがともに影響しないと明言し、Cloudflareも4条件の一つにその保証を入れています。どのページが学習に使われたかを確かめる手段は、Googleの数週間以内のツールと、Appleの来年の可視化を待つことになります。

検索で見つけてほしいか、学習に使われてよいか、を運営者が別々に決められるようになりました。両方を許すのも一つの答えで、Cloudflareの広告なしプリセットはそちらを既定値にしています。

まとめ(FAQ)

Q. この設定を有効にすると、AIに読まれなくなりますか?
A. 断れるのは、AIの学習に使う目的での読み取りです。検索の巡回は続きます。検索結果の上に出るAI要約は別の扱いで、いまは各社に直接設定する形です。Cloudflare上で一か所から度合いを決められる仕組みは、来年初頭を目標に準備中としています。

Q. GoogleとAppleは、Cloudflareに従ったのですか?
A. 両社は以前からrobots.txtで学習を断る名前 (Google-Extended / Applebot-Extended) を用意しており、Cloudflareはその記述を一括で設定します。Cloudflareが「説明責任がある」と呼んだのは、両社が4条件を満たしたか、満たす時期を約束したことです。

Q. Microsoftも同じですか?
A. Microsoftのrobots.txt対応は2027年初頭が目標で、現在はNOARCHIVEメタタグでの指定です。

Q. Cloudflareを使っていないサイトはどうすればよいですか?
A. robots.txtにGoogle-ExtendedとApplebot-ExtendedへのDisallowを書けば、AI学習だけを断る意思表示になります。robots.txtはお願いで、無視するクローラーには効きません。

検証メモ(出典と確認の範囲)
  • 本記事の数字と各社の状況は、Cloudflareのプレスリリースと公式ブログ (現地時間2026年9月15日(火)・日本時間でも同日夜) に基づきます。36.6%はプレスリリース、1%未満・17%・4条件・3社の時期・既定値・全プラン提供はブログの記載です。
  • 36.6%、1%未満、17%はCloudflareを通るサイトとクローラーの統計で、Web全体の比率とは別です。ブログ中の消費者側の数字 (AI要約を読む消費者の割合など) はブログ内に出典の記載を欠くため、本記事の対象外としました。
  • OpenAI・Anthropic・Meta・Amazonが検索用と学習用のクローラーを分けているという記述は、Cloudflareの公式ブログによります (ITmedia AI+ 2026年9月17日(木) も同旨)。
  • Google・Appleについては、Cloudflareが「4条件を満たした、または満たす時期を約束した」と認定したもので、GoogleのURL単位ツールは「数週間以内」、Appleの可視化は「来年」、Microsoftのrobots.txt対応は「2027年初頭目標」です。
  • CEO Matthew Prince氏の発言はプレスリリースの英文をQuotidiaが要約したものです (逐語訳とは別)。
  • 日本語では gihyo.jp (2026年9月16日(水))、ITmedia AI+ (2026年9月17日(木))、Real Sound テック (2026年9月17日(木)) が報じており、Cloudflareのプレスリリースにも日本語版があります。一般紙の報道は2026年9月18日(金) 時点で確認していません。
  • 日付は日本時間で記載しています。掲載日 (2026年9月21日(月)) 時点の情報です。

Quotidia の視点

検索には出たい、学習には使われたくない、という二つの希望は、これまで同じ一枚の札にしか書けなかった。Cloudflareが火曜日に出したのは、その札を二枚に分ける設定で、無料のプランにも配られた。QuotidiaのサイトはCloudflareの設定画面を使っていないので、手元にあるのはrobots.txtに自分で書く方法だけだ。そして、いまのQuotidiaのrobots.txtは、Google-ExtendedとApplebot-Extendedを含めて、AIのクローラーを明示的に許可している。読まれるために書いている記事を、検索にもAIにも開けている。では二枚に分けるのか。分ける費用はかからないが、分けたあとに検索の順位が動かないかどうかは、GoogleとAppleの「影響しない」という明言と、Cloudflareが4条件に入れた保証を信じる以外に、いまは確かめようがない。確かめる道具は、Googleが数週間以内、Appleが来年と言っている。順番として、道具が来てから札を分けるかどうかを決める。今日の時点では、一枚のまま置いておく。

関連記事:

運営: AI Quotidia 編集部

海外 AI ニュースを毎朝、日本語で解説する個人運営メディアです。記事は AI を活用して作成し、人手による確認・編集を経て公開しています。