検索設定の違いと使い分け
robots.txtは主にクローラーの取得、noindexは検索への登録、canonicalは重複・類似ページの代表URLを扱います。公開したい範囲と検索に載せたい範囲を先に決め、目的に合う設定を選びます。
- 取得、検索登録、代表URLの指定を分けて考える。
- robots.txtで拒否すると、そのページのnoindexを確認できない。
- 代表URLの指定は、内部リンクやサイトマップと矛盾させない。
3つの設定が扱うもの
- 01robots.txt
どの範囲を取得するか
- 02noindex
検索へ登録するか
- 03canonical
どのURLを代表にするか
設定の前に、ページの目的を決める
検索設定を整えるときは、各URLについて「取得させたいか」「検索に載せたいか」「どのURLを代表にしたいか」を先に決めます。見た目が似たページでも、サービス紹介、一覧の絞り込み、送信完了画面では目的が異なります。
社内だけの情報は、検索向けの設定だけで守ることはできません。認証やアクセス権限を別に設計し、公開範囲そのものを管理します。
3つの設定は、役割が異なる
canonicalはGoogleが正規URLを判断するためのシグナルです。指定先がそのまま採用されることを前提にせず、Search ConsoleでGoogleが選択したURLも確認します。
| 設定 | 主な役割 | できないこと・注意点 |
|---|---|---|
| robots.txt | 対象クローラーが取得する範囲を指定する | 拒否したURLが検索結果から必ず消えるわけではない |
| noindex | 取得したページを検索へ登録しないよう伝える | クローラーがページを取得できなければ指示を確認できない |
| canonical | 重複・類似ページのうち希望する代表URLを伝える | 非公開化や検索結果からの削除を指示する機能ではない |
robots.txtとnoindexの組み合わせに注意する
Googleがnoindexを読むには、ページを取得できる必要があります。robots.txtでそのページを拒否すると、HTMLやHTTPヘッダーにあるnoindexを確認できなくなります。検索から外したいからといって、拒否設定を重ねればよいわけではありません。
Googleはrobots.txt内のnoindex指定をサポートしていません。HTMLのrobotsメタタグ、または対象リソースに適したHTTPのX-Robots-Tagを使い、実際の応答に指示があるかを調べます。
よくあるページを、目的から判断する
これは判断の例です。絞り込みURLでも、独自の内容があり検索で見つけてもらう価値があれば、重複ページと同じ扱いにはできません。URLの形だけで一律に設定せず、内容と役割を見ます。
| ページの例 | 判断の方向 |
|---|---|
| 公開するサービス紹介 | 取得と登録を妨げず、代表URLへリンクをそろえる |
| 同じ内容の計測パラメータ付きURL | 重複内容と代表URLを照合し、canonicalを検討する |
| 一般公開の送信完了画面 | 検索へ載せる必要がなければnoindexを検討する |
| 社員・会員だけが見る情報 | 認証と権限で公開範囲を制御する |
canonical・内部リンク・サイトマップをそろえる
修正はまず少数の対象URLで確認し、テンプレート全体へ適用する範囲を決めます。設定の変更履歴を残すと、再取得後の変化を追いやすくなります。
- canonicalの指定先が取得でき、意図した内容を持つか確認する
- 代表URLにnoindexや不適切なリダイレクトがないか確認する
- 内部リンクとサイトマップで、異なる代表URLを示していないか調べる
- 開発環境のドメインや古いURLが残っていないか点検する
- URL検査で、設定した正規URLとGoogleが選んだ正規URLを比較する
QUERYAの実践提案
計測URLを、サービスの代表URLへそろえる
たとえば、同じサービス紹介に広告やメールの計測パラメータが付き、複数のURLで同じ内容が表示される場合です。
- 見直したい状態
- 重複を減らすため、パラメータ付きURLをrobots.txtで拒否。代表URLの指定や内部リンクは確認していない。
- 改善の方向
- 同じ内容かを照合し、希望する代表URLをcanonicalで伝える。内部リンクとサイトマップも代表URLにそろえ、検査で選択結果を確かめる。
確認を進める3つの手順
URLごとの目的を決める
公開範囲、検索へ載せる必要性、代表URLを一覧にします。
実際の応答を調べる
robots.txt、HTML、HTTPヘッダー、リダイレクト先を照合し、指示の矛盾を探します。
Google側の認識を確認する
修正後のライブテストと、再取得後の登録・正規URLを確認します。
よくある疑問
robots.txtで拒否すれば、検索結果から消えますか?
必ず消えるとは限りません。他のページからURLが発見され、内容を取得しないままURLが検索結果に出る場合があります。検索への登録を制御する目的と、取得の制御を区別します。
canonicalを全ページからトップページへ向けてもよいですか?
異なる内容のページを一律にトップページへ向ける設定は避けます。重複・類似した内容の関係を確認し、そのページに適した代表URLを示してください。
一次情報・公式の参考資料
確認日:。本文で使用した公式資料です。現在の提供条件は、以下の原資料でも確認できます。
この記事の更新履歴
公式資料を確認して公開。判断の流れを示す図解、具体的な見直し例、実践手順、よくある疑問を掲載。
記事に関するご連絡は、対象URLと該当箇所を添えてお知らせください。記事について問い合わせる
編集体制・掲載方針
QUERYA編集部が公式資料をもとに構成し、確認できる事実とQUERYAの見解・提案を分けて掲載します。統括責任者は木ノ根雄志、運営会社は株式会社ファーストイノベーションです。


