Skip to content
Search

重複コンテンツのSEO:URLの混乱を減らして可視性を守る

重複ページの発見方法、canonicalやリダイレクトでランキングシグナルを統合する方法、修正の検証、よくある実装ミスを回避する手順。

Duplicate Content SEO: Reduce URL Confusion & Protect Visibi

重複コンテンツが重要な理由

重複コンテンツとは、複数の異なるURLでアクセスできる実質的に同一または非常に類似したコンテンツを指します。問題が発生するのは検索エンジンがどのURLをクロールし、インデックス化し、ランク付けするかを決定しなければならないときです。その判断は内部リンクや外部のbacklinkシグナルを分散させ、低価値な重複ページにクロール資源を浪費させ、意図したcanonicalページの可視性を下げる可能性があります。

クロール、インデックス、ランキング — 三つの別個の段階

クロール、インデックス化、ランキングはそれぞれ別物として扱ってください。クロールは発見と取得、インデックスはURLのコンテンツが検索用に保存されるかどうか、ランキングは結果の順位付けです。重複コンテンツは各段階に異なる影響を与えます。たとえば、重複ページがクロールバジェットを消費する、検索エンジンが予期しない別のURLをインデックスする、ランキングシグナル(内部リンク、被リンク、コンテンツの質)がコピー間で分散することがあります。

よくある原因とパターン

重複コンテンツは、技術的なURLパターンや意図的な公開の選択から発生することが多いです。以下は典型的な原因と考慮すべき実務上のトレードオフです。

URLパラメータとファセットナビゲーション

フィルタ、ソート、解析用パラメータは、類似したコンテンツを表示する複数のURLを生みます(例: ?sort=price や ?utm_source=newsletter)。大規模なカタログでは、ファセットナビゲーションが大量の類似ページを生むことがあります。対策としては、望ましい表示にcanonical化する、価値の低いパラメータ組み合わせをrobotsディレクティブやサーバー側ロジックでブロックする、内部リンクがcanonicalバージョンを指すようにする、などがあります。

HTTPとHTTPS、およびサブドメイン/ホストのバリアント

プロトコルの混在(HTTP/HTTPS)やホスト(www/non-www)の違いは、一貫してcanonical化とリダイレクトを行わない限り重複コンテンツを生みます。確実なアプローチは、単一のcanonicalホスト名を採用し、デフォルトをHTTPSにして代替からサーバー側で301リダイレクトすることです。

末尾スラッシュとindexドキュメント

/page と /page/、あるいは index.html の有無で到達可能なページは、リダイレクトまたはcanonicalタグで単一のcanonical URLに統一するべきです。

CMSのアーカイブ、タグページ、定型一覧

日付アーカイブ、タグページ、著者ページなど自動生成された一覧は、投稿の抜粋や全文を含むことが多いです。これらのページが固有の有用性を提供しているかを判断し、そうでなければ低価値のアーカイブをnoindexにするか、canonicalタグで統合してください。

商品バリエーションと印刷用バージョン

多数のSKUや印刷用コピーのあるEコマースサイトは、ほぼ重複するページを作ることがあります。主要コンテンツを共有する商品バリエーションには、単一のcanonical商品ページを優先し、可能なら構造化データでバリアント属性を記述するか、固有の組み合わせ向けにパラメータ化されたcanonicalパターンを検討してください。

シンジケーションとクロスサイトのコピー

シンジケートされたコンテンツ、ゲスト投稿、再掲載記事はクロスドメインの重複を生むことがあります。理想的には公開先がオリジナルを指すrel=\"canonical\"を追加するか、抜粋とリンクを掲載します。canonicalの協力が得られない場合は、再掲載コピーにnoindexを付けるか、オリジナルが優先されるようにしてください。

統合方法:実践的な修正と使用タイミング

編集方針と技術的制約に合った、最小限かつ恒久的な修正を選んでください。以下の選択肢をツールとして使い、それぞれにトレードオフがあることを理解しましょう。

301リダイレクト — いつリダイレクトを優先すべきか

恒久的にURLを統合したい場合(例:末尾スラッシュの除去、HTTPSへの切替、重複記事の統合など)はサーバー側の301リダイレクトを使ってください。リダイレクトはユーザーのトラフィックと大部分のリンクエクイティを転送し、重複URLが繰り返しクロールされるのを防ぎます。

Rel=canonical — canonicalを使うべき場合

優先URLを示すcanonicalリンク要素を追加する: <link rel=\"canonical\" href=\"https://example.com/preferred-page\" />。canonicalは複製を公開したままにする必要がある場合(印刷用、パラメータ付きURLなど)に使いますが、検索エンジンにシグナルを一つのcanonical URLに集約してほしい場合に有効です。canonicalが200ステータスを返し、インデックス可能なページを指していることを確認してください。

低価値または薄いコピーにはNoindexを

ユーザーのためにページを残す必要があるがインデックスしてほしくない場合は、meta robots noindexを追加してください: <meta name=\"robots\" content=\"noindex\">。noindexはURLが検索結果に表示されるのを防ぎますが、クロールをブロックするrobotsディレクティブと組み合わせない限りクロール自体を防ぐものではない点に注意してください。

Rel=canonical とリダイレクト:判断チェックリスト

ユーザー向けの目的がないか恒久的な統合を望む場合はリダイレクトを使います。フィルタ、トラッキングパラメータ、印刷ビューなど、ユーザーのユースケースが異なるが検索エンジンにはシグナルを集約したい場合は rel=canonical を使います。ユーザーには公開したままにしたいが検索結果から除外したい場合は noindex を使ってください。

シンジケーション、ゲスト投稿、そして有料掲載

サードパーティサイトにコンテンツを公開する場合(ゲスト投稿、プレスリリース、シンジケーション)、公開先とcanonical化や抜粋形式について合意してください。全文が再掲載される場合、推奨される選択肢は公開者側でオリジナルを指す rel=\"canonical\" を入れること、抜粋とリンクを掲載すること、または再掲載コピーに noindex を付けることです。

有料掲載やスポンサーコンテンツは追加のコンプライアンス上の考慮点があります。Googleのガイダンスでは、ランキング操作を目的としたリンクをリンクスパムと見なし、有料リンクには rel=\"sponsored\" または rel=\"nofollow\" の使用を推奨しています。rel=\"nofollow\" と rel=\"sponsored\" は検索エンジンにとってリンクの性質を理解するためのヒントとして扱われます。リンクの主目的がランキング操作である場合、編集コンテンツと見分けがつかない形で有料コンテンツを提示することは避けてください。

開示とリンク処理のためのマークアップ例:通常の編集リンク:example。 スポンサー/有料リンク:example。 ユーザー生成コンテンツのリンク:example

検証と監視のチェックリスト

ツールと観察可能なチェックで修正を検証してください。以下の手順は自社ページとサードパーティページの両方に使えます。

自社で所有するページ向け

1) 次を使用する: Google Search ConsoleURL InspectionでGoogleがURLをどのように見ているか(インデックス状況、Googleが選択したcanonicalなど)を確認します。2) 類似URL群のCoverageやIndexingレポートを確認します。3) サーバーログを点検して、Googlebot Smartphoneがcanonical URLをフェッチしているかを確認してください(Googleはデフォルトでモバイル版を使用します;July 2024 以降、Googlebot Smartphone がデフォルトのcrawler)。4) curl を使ってヘッダとHTMLを取得します。ヘッダのみ取得するには: curl -I https://example.com/page。特定のUser-AgentでHTMLを取得するには: curl -A \"Googlebot/2.1 (+http://www.google.com/bot.html)\" https://example.com/page。5) ブラウザのDevTools(ElementsとNetwork)を使い、レンダリングされたDOMにcanonicalリンク要素が存在することを確認してください。

サードパーティの公開ページ向け

所有していないドメインには通常 URL検査を使えないため、外部チェックに頼ります: 1) curl(またはブラウザのview-source)でページのHTMLを取得して、リンクやrel属性がHTMLに存在することを確認します。2) ページが200 OKを返すことを curl -I と確認し、X-Robots-Tagヘッダがあればチェックします。3) Chrome DevToolsのレンダリングされたDOMを使ってリンクが表示され、クローラーにブロックされる可能性のあるクライアントサイドスクリプトによって注入されていないことを確認します。4) site: 演算子はGoogleがページを認識していることの目安になりますが、決定的なものではない(site: はノイズが多く、正確なインデックス確認には向かない)ことを覚えておいてください。

よくある実装ミス

重複コンテンツ対策で繰り返し起こる以下の誤りを避けてください:

• canonicalがインデックス不可か404のURLを指すように追加してしまう。canonicalは生存していてインデックス可能なページを指すべきです。
• リダイレクトと矛盾するcanonicalを混在させる(あるURLをリダイレクトしつつ、元のページに別のcanonicalを残す)。シグナルは一貫させ、主要な統合方法を一つにすることを推奨します。
• ページをnoindexで隠しつつ、同時にrobots.txt。もしURLがrobots.txtでブロックされていると、検索エンジンはページHTML内のnoindex指示を見られません。
• 恒久的な統合が必要な場合にrel=canonicalだけに頼ること;恒久的なURL変更にはリダイレクトを優先してください。
• rel=nofollowをリンク価値の完全な除外と扱うこと。nofollow と sponsored はヒントであり、検索エンジンは文脈に応じて扱いを変える可能性があります。

実践例

フィルタページの統合

/shoes と /shoes?color=blue が実質的に同じコンテンツを表示するなら、/shoes をcanonicalにし、内部のファセットリンクが適切にcanonicalのベースを指すようにしてください。インデックスしてほしくない深いフィルタの組み合わせについては、該当するパラメータ表示に noindex を検討してください。

シンジケーションのワークフロー

記事をシンジケートする際、公開者に <link rel=\"canonical\" href=\" を追加するよう依頼するか、抜粋とフル記事へのリンクを掲載してください。https://origin.example/article\"> をヘッドに追加するか、抜粋とフル記事へのリンクを公開してください。もし公開者が拒否する場合は、オリジナルにcanonicalを残し、sitemapsや内部リンクなど強力な内部シグナルを使って検索エンジンにあなたのページを主要なものと認識させてください。

支援を求めるタイミングと監査のヒント

ファセットナビの爆発や多くのパラメータ組み合わせのように重複パターンが広範囲に及ぶ場合は、フォーカスした監査を行ってください: URLパターンをマップし、HTTPレスポンスをサンプリングし、サーバーログでGooglebotがリクエストしているURLを確認します。外部リンク、オーガニックインプレッション、または顕著なクロールの注目を集めているURLを優先して修正を行ってください。

外部の公開者と共同でゲスト投稿や掲載を行う場合は、公開前にインデックス可能性とcanonical化を確認してください。有料掲載の場合は、検索エンジンの有料リンクに関するガイダンスに従い、明確な開示と適切なrel属性を要求してください。

リソースと次のステップ

この章に関連する技術的修正のより広いチェックリストを参照したい場合は、以下を見てください:Technical SEO Guide を読むcanonical化、sitemaps、クロール管理に関するサイト全体のベストプラクティスについて。

FAQ

重複コンテンツは手動ペナルティの原因になりますか?

重複コンテンツ自体が手動の処置を引き起こすことは稀です。Googleは手動対応(レビュアーによるもの)とアルゴリズムによる調整を区別しています。ただし、重複コンテンツはアルゴリズムによるフィルタリングを招いたり、ランク付けしたいページの可視性を下げたりするため、単にコンプライアンスの問題としてではなく、効率性と構造の問題として対処してください。

シンジケートされたコピーには rel=canonical と noindex のどちらを使うべきか?

公開者が協力できるなら、公開者側でオリジナルを指す rel=\"canonical\" を設置することを優先してください。できない場合は、抜粋とリンクのみを掲載するか、再掲載コピーに noindex を使うのが現実的な代替策です。どちらが適切かは公開者のオーディエンスのニーズと、オリジナルをインデックスされたソースにしたいあなたの優先度によります。

canonicalが適用されているかどうかをどう確認するか?

自社で所有するページについては、Google Search Console の URL Inspection を使って Google がどのURLをcanonicalとして選んだかを確認してください。サーバーログで Googlebot のリクエストを確認し、ページのHTMLやレンダリングされたDOMを取得して、canonical要素が存在し、インデックス可能なページを指していることを確認してください。

rel=nofollow はリンクのSEO価値を失わせますか?

rel=\"nofollow\" は厳密な除外ではなくヒントとして扱われます。検索エンジンは文脈に応じて扱いを変える可能性があります。有料リンクには rel=\"sponsored\" を使い、補償された掲載であることを明確にしてください。

URLを統合した後に行うべき簡易チェックは?

リダイレクトが301を返しcanonicalに到達することを確認し、レンダリングされたHTMLでcanonicalタグを検証し、URL Inspectionでインデックス状況を確認してください。対象URLのインプレッションとクリックをPerformanceレポートで経時的に監視し、サーバーログも確認してクローラーが意図したURLを優先していることを確かめてください。

Related articles