30秒で理解
noindexは、そのページやファイルを検索結果に登録・表示しないよう検索エンジンへ伝える指示です。 ページを非公開にしたり、閲覧者のアクセスを止めたりする機能ではありません。URLを知っている人が開ける状態のまま、検索結果への掲載だけを抑えたいときに使います。
noindexは、図書館の本に「蔵書検索には載せない」と札を付けることです。本を鍵付きの部屋へ移す機能ではないので、機密情報を守るには認証やアクセス制御を使います。
どういう仕組みか
HTMLページでは<head>内にrobots metaタグを置き、HTML以外のPDF・画像・動画などではHTTPレスポンスヘッダーのX-Robots-Tagを使えます。Googleは、クローラーがページを取得してこの指示を読めたときに検索結果から外します。
| 対象 | 設定方法 | 記述例 | 確認すること |
|---|---|---|---|
| HTMLページ | head内のrobots metaタグ | <meta name="robots" content="noindex"> | 公開HTMLにタグが出ているか |
| PDF・画像など | HTTPレスポンスヘッダー | X-Robots-Tag: noindex | 対象レスポンスにヘッダーが付くか |
| 特定のGoogleクローラーだけ | クローラー名を指定したmetaタグ | <meta name="googlebot" content="noindex"> | 対象を限定する必要が本当にあるか |
| robots.txt | noindexの設定場所ではない | Disallowとは別の指示 | クロールを遮ってタグを読めなくしていないか |
noindexとnofollowは別の指示です。リンクをたどらせない指定も同時に行う場合だけ、noindex, nofollowのように組み合わせます。robots.txtにnoindexを書いても、Googleのnoindex指定としては機能しません。
どこで見えるか
設定したページがGoogleからどう見えているかは、Search Consoleの「URL検査」で確認します。登録済みの情報と、現在のページを調べるライブテストは別なので、両方の結果を分けて読みます。
| 確認する場所 | 開く項目 | 判定 |
|---|---|---|
| Search Console → URL検査 | 「インデックス登録の結果」 | 「インデックス登録を許可」の状態を確認する |
| URL検査 → ページのインデックス登録 | 「クロールが許可されているか」 | いいえならrobots.txtやアクセス制限が先の問題 |
| URL検査 → ページのインデックス登録 | 「ページの取得」 | 成功していなければHTMLやヘッダーを読めていない |
| URL検査 → 公開URLをテスト | 「テスト済みページを表示」 | Googleが受け取ったHTMLやレスポンスを確認する |
| Search Console → ページのインデックス登録 | noindexに関する理由 | Googlebotがnoindexを検出したURLをまとめて確認する |
よくある誤解
robots.txtで対象URLをブロックしたままでは、noindexを設定してもGoogleが読めません。検索結果から外す指示を届けたいページは、まずGooglebotが取得できる状態にします。非公開情報そのものを守る場合は、noindexではなく認証やアクセス制御を使います。
| 誤解 | 実際の切り分け |
|---|---|
| noindexを付ければURLへ誰もアクセスできない | noindexは検索結果への掲載を抑える指示。閲覧制限は認証やサーバー設定で行う |
| robots.txtにnoindexと書けばよい | GoogleがサポートするnoindexはmetaタグまたはHTTPレスポンスヘッダーで設定する |
| 設定した瞬間に検索結果から消える | Googleが再クロールして指示を確認した後に反映される。現在の状態はURL検査で確認する |
| noindexとnofollowは同じ | noindexは掲載、nofollowはリンクの扱いに関する別の指示 |
| ライブテストが通れば検索結果から外れている | ライブテストは現在のページの取得結果。インデックス済みの状態は検査結果のページも読む |
これを踏まえて何をするか
検索結果から外したいURLを1つに絞り、次の順で設定と反映を確認します。
| 順番 | 開く場所 | 操作 | 判定 |
|---|---|---|---|
| 1 | CMSまたはHTMLのhead | 対象HTMLに<meta name="robots" content="noindex">を追加する。PDFなどは配信設定でX-Robots-Tag: noindexを返す | 対象URLの種類に合った設定になっている |
| 2 | サイトのrobots.txt | 対象URLをDisallowで塞いでいないか確認する | 塞いでいれば、noindexを読ませる対象だけブロックを外す |
| 3 | Search Console → URL検査 | 完全な対象URLを入力し、「公開URLをテスト」を押す | クロール許可とページ取得が成功している |
| 4 | URL検査 → テスト済みページを表示 | Googleが受け取ったHTML、またはレスポンスヘッダーを開く | noindexが実際に含まれている |
| 5 | URL検査のインデックス登録結果 | 登録状態と「インデックス登録をリクエスト」を確認する | 既存の検索表示を早く止める必要があれば、別途Search Consoleの削除機能を検討する |
最初に押す場所は、Search Console上部の「URL検査」です。検索結果から外したいURLを1つ入力し、まず「クロールが許可されているか」と「ページの取得」を開いてから、noindexがGoogleに届いているかを確認してください。