この記事の結論
noindexは「このページを検索結果に出さないで」という指示で、robots.txtは「このURLを読みに来ないで」というお願いです。
止めているものが違うので、検索結果から外したいページには noindex を使い、robots.txt では止めません。
robots.txt で読み取りを止めると、Googleはページの中の noindex を読めず、ほかのサイトからリンクされていれば、URLだけが検索結果に出ることがあります。
PDFのようにHTMLでないファイルは、サーバーの応答に X-Robots-Tag: noindex を付けて外します。
付けた後は Search Console のURL検査で、Googleが noindex に気づいたかを確かめます。
急ぐときは削除ツールで一時的に隠し、そのあいだに noindex や削除で恒久的に外します。
止めているものが、そもそも違う
robots.txt は、クローラーに「サイトのどのURLを読んでよいか」を伝えるファイルです。
Googleは、これをページを検索結果に出さないための仕組みではない、とはっきり書いています(Google 検索セントラル:robots.txt の概要とガイド、2026年10月4日確認)。
止めたURLでも、ほかのサイトからリンクされていれば、説明文のない形で検索結果に出ることがある、というのが同じページの説明です。
noindex のほうは、読んだうえで「検索結果に出さない」と決める指示です。
ページを読ませないかぎり、指示そのものが届きません。
robots.txt の Disallow | <meta name="robots" content="noindex"> | X-Robots-Tag: noindex | |
|---|---|---|---|
| 伝えること | このURLを読みに来ないで | このページを検索結果に出さないで | このファイルを検索結果に出さないで |
| 書く場所 | サイト直下の robots.txt | ページのHTMLの <head> の中 | サーバーが返す応答のヘッダー |
| 効く相手 | フォルダ単位やサイト全体で、まとめて | そのページだけ | 設定しだいで、1ファイルからサイト全体まで |
| HTML以外のファイル | 止められる | 書けない | PDFや画像にも付けられる |
| 検索結果から外れるか | 外れるとは限らない | 次に読まれたときに外れる | 次に読まれたときに外れる |
meta タグとヘッダーは、書く場所が違うだけで、使える指示は同じです(Google 検索セントラル:robots meta タグ、data-nosnippet、X-Robots-Tag の指定、2026年10月4日確認)。
両方かけると、noindex は読まれない
いちばん起こりやすいのは、念のため両方かけておこう、という組み合わせです。
Googleは、noindex を効かせるには robots.txt でページをブロックせず、クローラーがページにアクセスできるようにしておく必要がある、と書いています(Google 検索セントラル:noindex を使用して検索インデックス登録をブロックする、2026年10月4日確認)。
読み取りを禁じたURLでは、noindex を含めた検索結果への出し方の指示は見つけられず、無視されることになります(robots meta タグのページ)。
Search Console のURL検査でも、この状態は見分けにくくなります。
robots.txt でブロックしているURLでは、「インデックス登録を許可?」の欄が常に「はい」と出る、とヘルプにあります(Search Console ヘルプ:URL 検査ツール、2026年10月4日確認)。
noindex を書いたのに「はい」と出ていたら、まず robots.txt を疑います。
私たちのサイトにも、この組み合わせがありました。
git の履歴をたどると、2026年5月24日の最初の版から、robots.txt は Disallow: / でサイト全体を止め、同時に全ページに X-Robots-Tag: noindex, nofollow を付ける設定にしていました。
さらにその手前に、ログインしないと開けない入口を置いていました。
6月27日に robots.txt を Allow: / に変え、6月30日に入口とヘッダーの noindex を外して、検索に出せる状態にしています。
ファイルの上では、5月から6月27日までの noindex は、robots.txt の陰に隠れる書き方でした。
ただ、実際には robots.txt も入口の後ろにあり、ログインしていないGoogleが受け取れたのは、ログインを求める画面だけでした。
Googleは、robots.txt を取りに来て 4xx のエラー(429 を除く)が返ると、robots.txt がないもの、つまり読み取りの制限がないものとして扱います(Google 検索セントラル:Google による robots.txt の指定の解釈、2026年10月4日確認)。
つまり、書いた Disallow: / も noindex のヘッダーもGoogleには届いておらず、検索から隠していたのはログインの入口でした。
重ねた設定のうち、効いていたのは1つだけだったことになります。
Googleも、検索に出さない方法の1つに、パスワードで守って許可した人だけが開けるようにすることを挙げています(Google 検索セントラル:Google 検索からコンテンツを削除する、2026年10月4日確認)。
どちらを使うか
迷ったら、「検索結果から外したいのか」「読みに来ること自体を減らしたいのか」で分けます。
| したいこと | 使うもの | 理由 |
|---|---|---|
| 公開しているページを、検索結果にだけ出さない | noindex(meta タグ) | 読ませたうえで外せる |
| PDFや画像を、検索結果に出さない | X-Robots-Tag | HTMLでないので meta タグが書けない |
| 公開前のサイトや、社内向けのページを見せない | パスワード(ログイン) | 人にもクローラーにも開けない |
| ページそのものを消した | 404 か 410 を返す | もう存在しないと伝える |
| 絞り込みの組み合わせで無数にできるURLを、読みに来させない | robots.txt | 読み取りの量を減らすのが目的 |
robots.txt が向いているのは、最後の行のような、読み取りの量を抑えたいときです。
検索結果から外す目的で使う場面は、ほぼありません。
noindex の書き方
ページに書くなら、<head> の中に次の1行を入れます。
<meta name="robots" content="noindex">
ヘッダーで付けるなら、サーバーの応答に次の行が入るように設定します。
X-Robots-Tag: noindex
設定の場所は、使っているサーバーやサービスによって変わります。
私たちが開発中に使っていたのは、配信サービスの _headers という設定ファイルで、/* の下に1行足すだけで全ページに付く設定です。
手軽なぶん、外し忘れたときの影響もサイト全体に及びます。
nofollow は「このページのリンクをたどらない」という別の指示です。
ページだけを外して、ページの中のリンクはたどってほしいなら、付けません。
付けたら、URL検査で確かめる
noindex は、Googleが次にそのページを読んだときに効きます。
ページによっては、読み直しまで数か月かかることもあり、URL検査から読み直しを頼めます(noindex のページ、2026年10月4日確認)。
確かめる場所は、Search Console のURL検査です。
- 上の検索窓に、外したいページのURLを入れる
- 「公開URLをテスト」で、いまのページに noindex が入っているかを見る
- 「インデックス登録を許可?」が「いいえ」になっているかを見る
- 「クロール済みのページを表示」で、Googleが受け取ったHTMLや応答のヘッダーを見る
画面の上に出る結果は、前回登録されたときの状態で、いま公開しているページと同じとは限りません(URL 検査ツールのヘルプ)。
「公開URLをテスト」と見比べるのはそのためです。
私たちは2026年10月3日の夜、関西の外の8県を扱った記事を、消さずに noindex にしました。
robots.txt には手を入れず、記事のページに <meta name="robots" content="noindex, follow"> を書いています。
同時に、サイトマップ、記事の一覧、関連記事の欄からも外しました。
noindex を付けたページをサイトマップに残すと、検索に出したいのか出したくないのか、食い違った知らせ方になるからです。
翌10月4日に、8本をURL検査の仕組み(API)で調べた結果は次のとおりです。
| 状態 | 本数 | Googleが最後に読んだ日時(日本時間) |
|---|---|---|
| noindex タグによって除外されました | 4 | 10月3日23時台〜10月4日17時台 |
| 登録済みのまま | 1 | 10月2日(noindex を付ける前) |
| URL が Google に認識されていません | 3 | 記録なし |
4本は、付けた当日の夜から翌日にかけて読み直され、外れていました。
1本は、noindex を付ける前の10月2日に読まれたきりで、まだ登録されたままです。
残りの3本は、もともとGoogleに見つかっていませんでした。
同じ日に同じ書き方で付けても、外れる日はページごとに違います。
急いで消したいときは、削除ツール
誤って公開した情報のように急ぐときは、Search Console の削除ツールを使います。
自分のプロパティのURLなら、リクエストの処理は長くても1日ほどです(Search Console ヘルプ:削除ツール、2026年10月4日確認)。
ただし、効き目はおよそ6か月の一時的なものです。
そのあいだに、ページを消して404か410を返すか、パスワードをかけるか、noindex を付けて、恒久的に外します。
削除ツールのヘルプも、ブロックする手段として robots.txt を使わないように書いています。
よくある質問
robots.txt で止めたページが、検索結果に出てしまいます。どうすればいいですか?
noindex と robots.txt の両方を書いておけば、より確実ですか?
noindex を付けたページは、サイトマップから外すべきですか?
noindex を付けてから、どのくらいで検索結果から消えますか?
ほかの検索エンジンでも、noindex は同じように効きますか?
robots.txt の書き方そのものと、AIのクローラーの分け方はrobots.txtとはに、サイトマップに載せるURLの決め方はサイトマップの作り方に書いています。
bundlyzeは、大阪市北区のグラングリーン大阪を拠点に、大阪・兵庫を中心とした関西の会社からのご相談に対応していて、打ち合わせはWeb会議でも対面でもできます。
全国からオンラインでもご相談いただけます。
この記事を書いた津嘉山は、業務システム開発とAWSを専門とするエンジニアで、このサイトの開発中の目隠しの設定も、記事を noindex にする仕組みも自分で組み、URL検査の結果を API で取り出して確かめています。
外したいページがあるなら、まず robots.txt でそのURLを止めていないかを見てから、noindex を書くのが順番です。
ご相談
検索やAIでの見つかり方について、いまの状況をお聞かせください。
「何から手をつければいいか分からない」という段階からで構いません。返信は担当者が直接お送りします。