最初に結論

検索設定の違いと使い分け

robots.txtは主にクローラーの取得、noindexは検索への登録、canonicalは重複・類似ページの代表URLを扱います。公開したい範囲と検索に載せたい範囲を先に決め、目的に合う設定を選びます。

  • 取得、検索登録、代表URLの指定を分けて考える。
  • robots.txtで拒否すると、そのページのnoindexを確認できない。
  • 代表URLの指定は、内部リンクやサイトマップと矛盾させない。

3つの設定が扱うもの

  1. 01
    robots.txt

    どの範囲を取得するか

  2. 02
    noindex

    検索へ登録するか

  3. 03
    canonical

    どのURLを代表にするか

役割を区別したうえで、ページごとの公開方針に合わせて使います。
01

設定の前に、ページの目的を決める

検索設定を整えるときは、各URLについて「取得させたいか」「検索に載せたいか」「どのURLを代表にしたいか」を先に決めます。見た目が似たページでも、サービス紹介、一覧の絞り込み、送信完了画面では目的が異なります。

社内だけの情報は、検索向けの設定だけで守ることはできません。認証やアクセス権限を別に設計し、公開範囲そのものを管理します。

02

3つの設定は、役割が異なる

canonicalはGoogleが正規URLを判断するためのシグナルです。指定先がそのまま採用されることを前提にせず、Search ConsoleでGoogleが選択したURLも確認します。

3つの設定は、役割が異なる
設定主な役割できないこと・注意点
robots.txt対象クローラーが取得する範囲を指定する拒否したURLが検索結果から必ず消えるわけではない
noindex取得したページを検索へ登録しないよう伝えるクローラーがページを取得できなければ指示を確認できない
canonical重複・類似ページのうち希望する代表URLを伝える非公開化や検索結果からの削除を指示する機能ではない
03

robots.txtとnoindexの組み合わせに注意する

Googleがnoindexを読むには、ページを取得できる必要があります。robots.txtでそのページを拒否すると、HTMLやHTTPヘッダーにあるnoindexを確認できなくなります。検索から外したいからといって、拒否設定を重ねればよいわけではありません。

Googleはrobots.txt内のnoindex指定をサポートしていません。HTMLのrobotsメタタグ、または対象リソースに適したHTTPのX-Robots-Tagを使い、実際の応答に指示があるかを調べます。

04

よくあるページを、目的から判断する

これは判断の例です。絞り込みURLでも、独自の内容があり検索で見つけてもらう価値があれば、重複ページと同じ扱いにはできません。URLの形だけで一律に設定せず、内容と役割を見ます。

よくあるページを、目的から判断する
ページの例判断の方向
公開するサービス紹介取得と登録を妨げず、代表URLへリンクをそろえる
同じ内容の計測パラメータ付きURL重複内容と代表URLを照合し、canonicalを検討する
一般公開の送信完了画面検索へ載せる必要がなければnoindexを検討する
社員・会員だけが見る情報認証と権限で公開範囲を制御する
05

canonical・内部リンク・サイトマップをそろえる

修正はまず少数の対象URLで確認し、テンプレート全体へ適用する範囲を決めます。設定の変更履歴を残すと、再取得後の変化を追いやすくなります。

  • canonicalの指定先が取得でき、意図した内容を持つか確認する
  • 代表URLにnoindexや不適切なリダイレクトがないか確認する
  • 内部リンクとサイトマップで、異なる代表URLを示していないか調べる
  • 開発環境のドメインや古いURLが残っていないか点検する
  • URL検査で、設定した正規URLとGoogleが選んだ正規URLを比較する

QUERYAの実践提案

計測URLを、サービスの代表URLへそろえる

たとえば、同じサービス紹介に広告やメールの計測パラメータが付き、複数のURLで同じ内容が表示される場合です。

見直したい状態
重複を減らすため、パラメータ付きURLをrobots.txtで拒否。代表URLの指定や内部リンクは確認していない。
改善の方向
同じ内容かを照合し、希望する代表URLをcanonicalで伝える。内部リンクとサイトマップも代表URLにそろえ、検査で選択結果を確かめる。

確認を進める3つの手順

  1. URLごとの目的を決める

    公開範囲、検索へ載せる必要性、代表URLを一覧にします。

  2. 実際の応答を調べる

    robots.txt、HTML、HTTPヘッダー、リダイレクト先を照合し、指示の矛盾を探します。

  3. Google側の認識を確認する

    修正後のライブテストと、再取得後の登録・正規URLを確認します。

よくある疑問

robots.txtで拒否すれば、検索結果から消えますか?

必ず消えるとは限りません。他のページからURLが発見され、内容を取得しないままURLが検索結果に出る場合があります。検索への登録を制御する目的と、取得の制御を区別します。

canonicalを全ページからトップページへ向けてもよいですか?

異なる内容のページを一律にトップページへ向ける設定は避けます。重複・類似した内容の関係を確認し、そのページに適した代表URLを示してください。

一次情報・公式の参考資料

確認日:。本文で使用した公式資料です。現在の提供条件は、以下の原資料でも確認できます。

この記事の更新履歴

  1. 公式資料を確認して公開。判断の流れを示す図解、具体的な見直し例、実践手順、よくある疑問を掲載。

記事に関するご連絡は、対象URLと該当箇所を添えてお知らせください。記事について問い合わせる

EDITORIAL POLICY

編集体制・掲載方針

QUERYA編集部が公式資料をもとに構成し、確認できる事実とQUERYAの見解・提案を分けて掲載します。統括責任者は木ノ根雄志、運営会社は株式会社ファーストイノベーションです。