監査ツールの画面に「重複コンテンツなし」と出た。その瞬間、多くのチームは重複という原因を候補から外します。ここに落とし穴があります。検出されなかったことは、存在しないことの証明ではありません。
テクニカルSEO監査には、比較の対象にすら乗らないURLが存在します。乗らなかったものは、当然ながら「一致率が低い」とも「一致率が高い」とも判定されません。画面には何も出ません。何も出ないことと、問題が無いことは違います。
この記事では、公開されている仕様をもとに構成した仮想のケースを使って、機械検査が拾える範囲と拾えない範囲を分けます。根拠はGoogleとScreaming Frogの公式ドキュメントです。原因が見つからないまま時間だけが過ぎる、あの状態を避けたい方に向けて書きました。
こんなふうに調べていませんか
- 「テクニカルSEO監査 見落とし 事故」で検索して、自社の監査手順に穴がないか確かめたい
- 監査ツールでは問題が出ないのに、カテゴリページの調子が上がらない理由を探している
この記事を読み終えたときに手に入るもの
- 監査ツールの検出0件が、何を証明していないのかを説明できるようになります
- しきい値・設定・索引という3つの死角を、自社の手順書に落とせます
- 監査ツールとSearch Consoleを突き合わせる点検の型が身につきます
結論30秒でわかる、この記事の結論
- 検出0件は「重複が無い」ではなく「比較で引っかからなかった」という意味です。 比較の対象に乗らなかったURLは、そもそも画面に出てきません。
- 死角は3つあります。しきい値の高さ、検出を動かす設定の抜け、そしてGoogleがどのURLを正規に選んだかという索引側の判断です。
- 恒久対策は、単一ツールの表示を信じないこと。監査ツールとSearch Consoleを、同じレビューの場で並べます。
ここから先は、本誌が実際に運用した記録ではありません。公開されている仕様をもとに構成した仮想のシナリオであり、登場するサイトやチームは特定の実在団体を指しません。
01テクニカルSEO監査の見落としは、どんな事故として表に出るんですか?
若葉さん監査ツールで問題が出ていないのに、調子が上がらないことってあるんでしょうか。
鈴木さんあります。しかも、いちばん気づきにくい形で出ます。エラーが出ないので、探す場所が分からなくなるんです。
想定するのは、こういうサイトです。あるカテゴリページには、価格順・新着順の並び替え機能と、色やサイズで絞り込むフィルタ機能がありました。ユーザーが操作するたびに、別のURLが生成される作りです。
チームはテクニカルSEO監査として、Screaming FrogのNear Duplicates機能を実行しました。結果は「検出0件」でした。並行して、対象カテゴリのオーガニック経由の流入は横ばいが続いていました。
事故はここから始まります。「重複は0件」という表示があるので、重複コンテンツは原因候補から外れます。外れた原因は、二度と見直されません。表に出るのは、原因不明のまま時間だけが過ぎるという形です。
この章のまとめ
症状は「エラーが出ないのに改善しない」。原因候補から重複が外れた瞬間に、調査の方向が固定される。
02検出0件という表示は、テクニカルSEO監査で何を見ていないんですか?
「0件」という表示には、まったく違う2種類の意味が同居しています。
1つは、テキストが実際に比較され、しきい値未満だったという意味です。もう1つは、そもそも比較対象が1つしかなかったという意味です。前者は検査が働いた結果ですが、後者は検査が働かなかった結果です。
画面上では、この2つは区別されません。同じ「0」という数字で表示されます。
読み替えの手順はシンプルです。0件を見たら「重複が無い」ではなく、「今回の条件では引っかからなかった」と読みます。そのうえで、条件のほうを点検します。条件とは、何をクロールしたか、何と何を比べたか、どこにしきい値を置いたかの3つです。
この章のまとめ
0件には「比較して外れた」と「比較していない」の2つがある。画面はその違いを表示しない。
03並び替えやフィルタのURLは、なぜテクニカルSEO監査から抜け落ちるんですか?
まず、重複URLがどこで生まれるかを公式の記述で確認します。Google Search Centralは、並び替えやフィルタ機能で結果が生成される場合を、重複URLが生まれる重要な例として挙げています(出典: Google Search Central「正規化とは」・2026-08-08確認)。同ページは他にも、地域差・デバイス差・プロトコル差など5パターンを重複URLの発生要因として明記しています。
つまり、並び替えとフィルタを持つカテゴリページは、仕様上いちばん重複URLが生まれやすい場所です。
問題は、その生まれやすい場所ほどクロール設定で除外されやすいことです。Remove Parameters等の設定でパラメータ付きURLをクロール範囲から外していると、そのURLは比較表に一行も載りません。載らないものは、一致率を計算されることもありません。
生まれやすい場所と、監査の視界から外れやすい場所が重なっている。この重なりが死角の正体です。
この章のまとめ
並び替えとフィルタは公式が挙げる典型的な発生源。そして同じURLが、クロール設定で真っ先に除外される。
04コンテンツの質を疑う誤診は、テクニカルSEO監査の見落としをどんな事故に育てますか?
監査ツールが0件と報告した以上、重複という原因は消去できると考えるのは自然です。次に疑う先は、たいてい中身の話になります。
想定したチームも同じ道をたどりました。記事の情報量が足りないのではないか。E-E-A-Tが弱いのではないか。検索アルゴリズムの変動ではないか。いずれも真っ当な仮説です。
ただし、これらはすべて「重複0件」という前提の上に積まれた仮説でした。前提そのものを疑う発想には至っていません。前提が誤っていると、その上の仮説は全部外れます。しかも、外れていることに気づく手がかりが残りません。
そしてもう1つ、設定側の落とし穴があります。Screaming Frog公式ガイドによると、Near Duplicatesの検出には「Enable Near Duplicates」の設定が必要です。それだけでなく、クロール後に別途「Crawl Analysis」の実行が必要です(出典: Screaming Frog「Near Duplicates」・2026-08-08確認)。この2つの条件がそろって初めて、近似重複の判定が動きます。
高梨課長設定を入れただけでは動かない、ということですか。それは気づけないですね。
鈴木さん気づけないところが厄介です。動かなかった検査も、画面には0と出ます。 だから手順書に書いて、人の記憶から外すほうが安全だと考えられます。
この章のまとめ
誤診の怖さは、前提が誤っていても手がかりが残らないこと。設定の抜けも「0」として表示される。
05Near Duplicatesのしきい値は、テクニカルSEO監査の死角をどこに作りますか?
しきい値の話に入ります。Near Duplicatesの既定のしきい値は90%です。これを上回る一致がなければ、近似重複として表示されません(出典: Screaming Frog「Near Duplicates」・2026-08-08確認)。
ここから2つの死角が生まれます。
1つは、しきい値未満の一致です。並び順だけが違うカテゴリページは、商品説明の一部が入れ替わることで一致率が下がることがあります。人の目には同じページに見えても、機械の物差しでは別ページになります。
もう1つは、比較の母集団です。Near Duplicatesが比較するのは、クロールされたページのテキスト同士だけです。パラメータ違いのURLがクロール設定によって1つに正規化されていれば、比較対象は最初から1つしかありません。
この章のまとめ
死角は2種類。しきい値未満の一致と、そもそも比較の母集団に入っていないURL。
06生成AIの埋め込みを使えば、テクニカルSEO監査の見落としは埋まりますか?
意味の近さで測る方法もあります。ただし、これも万能ではありません。
Screaming Frogは2025年6月公開のv22.0で、OpenAI・Gemini・Anthropic・Ollamaという4つのAIプロバイダーと連携する機能を追加しました。この機能を設定すれば、クロールデータに対してカスタムプロンプトを実行できます。実行できる上限は最大100件です(出典: Screaming Frog「How To Crawl With AI Prompts」・2026-08-08確認)。
今回の症状に関わるのは、このAI連携機能そのものではありません。同じv22.0で強化された重複検出の仕組みのほうです。
Semantic Similarityは、LLM embeddingsによってページをベクトル化し、0.95を上回るスコアを意味的な近似と判定します(出典: Screaming Frog「Semantic Similarity」・2026-08-08確認)。テキストの一致では拾えない、言い回しが違うだけのページを拾える点が強みです。
ただし条件があります。対応プロバイダーはOpenAI・Google Gemini・Ollamaの3つで、Anthropicの明記はありません。設定には「Store HTML」の有効化を含む5つの手順が必要で、途中を1つ省くと機能自体が動きません。ここでも「動かなかった」と「見つからなかった」が、同じ表示に化けます。
この章のまとめ
意味の近さで測る方法は死角を狭めるが、条件は増える。手順を1つ落とすと機能そのものが動かない。
07canonicalを書けば、テクニカルSEO監査で正規URLは確定したと言えますか?
言えません。ここが3つ目の死角です。
Googleは正規URLの選定について、次のように明記しています。「正規化の希望を伝えることはできますが、確実ではありません」(出典: Google Search Central「正規化とは」・2026-08-08確認)。希望を伝える手段であって、指定する手段ではない、という位置づけです。
したがって、監査ツールでcanonicalタグの記述を確認できたとしても、Googleが実際にそのURLを正規に選んだかどうかは別問題です。書いてあることと、選ばれたことは違います。
ここまでの3つを1枚の表にまとめます。
| 仕組み | 何を比較するか | 見えない領域 |
|---|---|---|
| Near Duplicates(既定しきい値90%) | クロール済みページのテキスト同士 | クロールされなかったURL、しきい値未満の一致 |
| Semantic Similarity(既定しきい値0.95) | LLM embeddingsによる意味の近さ | 対応プロバイダーはOpenAI・Google Gemini・Ollamaの3つ(Anthropicの明記なし) |
| Googleの正規化(rel=canonical等) | クロール・索引の各シグナル | どのURLを正規と選ぶかは「ヒント」止まりで確定ではない |
3つの死角は、それぞれ別の層にあります。だから1つを塞いでも、残りの2つは開いたままです。
この章のまとめ
canonicalは希望を伝える手段。記述の確認と、Googleが選んだ結果の確認は、別の作業になる。
08Search Consoleのどのレポートが、テクニカルSEO監査の見落としを補いますか?
実際にどのURLが選ばれたかは、Search Consoleの「ページ インデックス登録レポート」でしか確認できません。同レポートが定義する未登録の理由は合計15個あります。そのうち3個が、重複・正規化に関するラベルです(出典: Search Console ヘルプ「ページ インデックス登録レポート」・2026-08-08確認)。代表的なものは次のとおりです。
- 重複していますが、ユーザーが正規ページとして選択していません
- 重複しています。Googleにより、ユーザーがマークしたページとは異なるページが正規ページとして選択されました
Screaming Frogの監査結果と、Googleの索引結果は別のレポートです。前者はクロールした側から見た景色、後者は索引した側から見た景色です。同じサイトでも、見えているものが違います。
若葉さん両方に同じことが書いてあるとは限らない、ということですか。
鈴木さんそうなんです。食い違っているときこそ、いちばん情報量があります。 そこが手を入れる場所だと考えられます。
だから片方だけでは全体像になりません。両方を並べて初めて、パラメータ違いのURLがどう扱われているかが分かります。
この章のまとめ
監査ツールはクロール側の景色、Search Consoleは索引側の景色。両方を並べないと全体像にならない。
09テクニカルSEO監査を二重化する運用は、具体的に何をやるんですか?
恒久対策は、単一のツールの「0件」表示を信じないことに尽きます。抽象的な心構えではなく、次の3つを運用の手順に組み込みます。
監査のたびに、この順で通します
設定と実行をセットにする
Screaming Frogでは「Enable Near Duplicates」に加え、必ず「Crawl Analysis」を実行します。設定を有効にしただけでは検出は動きません
除外したURLを見直す
Remove Parameters等でクロール範囲からURLを除外している場合、除外前のURLが本当に不要かを確認してから重複監査に進みます
索引側のラベルと突き合わせる
Search Consoleの「ページ インデックス登録レポート」で、重複・正規化ラベルの件数を毎回突き合わせます
3つ目が要です。監査ツールが0件でも、レポート側にラベルが出ていれば、実際には重複が存在します。この突き合わせがあるかどうかで、見落としの寿命が変わります。
この章のまとめ
やることは3つ。設定と実行をセットにする、除外を見直す、索引側のラベルと突き合わせる。
10URLパラメータツールが無いいま、テクニカルSEO監査はどこで代わりを立てますか?
かつては、パラメータごとの扱いをGoogleへ直接指示する画面がありました。Googleは2022年3月、Search ConsoleのURLパラメータツールを廃止しています。この廃止は公式発表のとおりです(出典: Google Search Central「URLパラメータツール廃止」・2026-08-08確認)。
パラメータごとの扱いを個別に指示する専用の管理画面は、現在は存在しません。指示する場所が無いということは、確認する場所も一元化されていないということです。
高梨課長専用の画面が無いなら、どこを代わりに見ればいいんでしょうか。
鈴木さん代わりは1か所ではありません。クロール設定と索引結果を、人が手で突き合わせる運用がその代わりになります。
だからこそ、前章の3つを手順書に書いておく価値があります。ツールが用意していない工程は、運用でしか埋まりません。
この章のまとめ
専用の管理画面はもう無い。クロール設定と索引結果を手で突き合わせる運用が、その代わりになる。
11同じ事故を繰り返さないために、テクニカルSEO監査の見落としをどう仕組みで止めますか?
再発防止の中心は、チェックのタイミングを制度化することです。個人の注意力に頼りません。注意力は、忙しい時期に真っ先に削られるからです。
テクニカルSEO監査を実施する際は、Screaming FrogとSearch Consoleの結果を、同じレビューの場で並べて確認します。時間を分けず、担当を分けず、同じ画面で見ます。片方だけを見て「問題なし」と結論づける運用は、レビューの手順書自体で禁止します。
- Near Duplicatesを実行する際、「Enable Near Duplicates」だけでなく「Crawl Analysis」も実行したか確認した
- パラメータ付きURLがRemove Parameters等の設定でクロール対象から外れていないか確認した
- 監査ツールの「検出なし」表示を、Search Consoleの「ページ インデックス登録レポート」の除外理由と突き合わせた
- 重複・正規化に関するラベルの件数を記録し、前回の監査結果と比較した
- rel=canonicalの記述と、Googleが実際に選んだ正規URLが一致しているかを確認した
- Semantic Similarityを使う場合、しきい値が自社サイトの文章量に対して妥当か確認した
- サイトマップに掲載しているURLが、正規URLだけになっているか確認した
- 「重複なし」という結果を、単一ツールの表示だけで結論づけていないか確認した
この章のまとめ
止めるのは人の注意力ではなく手順書。並べて見る場を作り、片方だけで結論づける運用を禁止する。
12AI検索向けのクローラー設定と、テクニカルSEO監査のクロール設定は同じ話ですか?
別の話です。ここを混ぜると、判断が絡まります。
パラメータURLをクロール対象から外すかどうかは、重複監査の精度に関わる設定です。一方、AIクローラーごとの許可・拒否設定は、自社のコンテンツをどう扱わせるかという別の判断になります。同じrobots.txtを触る作業でも、目的も判断材料も違います。
優先順位の話も添えておきます。テクニカルSEO全体で見たとき、重複コンテンツの削減は、クロール性の確保に次ぐ優先度に位置づけられます。土台が通っていなければ、その上の精度を上げても効きません。
若葉さんつまり、AI検索のための設定と、重複を見つけるための設定を、別々に書き出せばいいということですね?
鈴木さんそのとおりです。同じファイルを触るからといって、同じ判断ではありません。 目的ごとに分けて書くと、後から読んだ人も迷いません。
もう1つ、共通する考え方があります。大量のURLバリエーションが機械的に生まれる場面は、記事の量産でも起こります。どちらも、量ではなく「読者にとって別ページである必要があるか」で判断する点は同じです。
この章のまとめ
robots.txtを触る作業でも、AI検索向けの許諾と重複対策のクロール設定は別。判断材料が違う。
13よくある質問
テクニカルSEO監査で検出0件なら、重複は無いと考えていいですか
考えないでください。0件には「比較したうえで一致率が低かった」と「そもそも比較していない」の2つが含まれます。画面はこの違いを区別しません。0件を見たら、まずクロール範囲としきい値の設定を確認してください。
Near Duplicatesのしきい値は下げたほうがいいですか
下げれば拾える範囲は広がりますが、順番としては後です。比較の母集団に載っていないURLは、しきい値をどれだけ下げても出てきません。先に確認するのは、クロール範囲から除外しているURLがないかどうかです。
canonicalを書けば、Googleはそのとおりに正規URLを選んでくれますか
保証はありません。Googleは「正規化の希望を伝えることはできますが、確実ではありません」と明記しています(出典: Google Search Central「正規化とは」)。記述の確認と、選ばれた結果の確認は別の作業として扱ってください。
Semantic Similarityを使えば、Near Duplicatesは要らなくなりますか
置きかえの関係ではありません。前者は意味の近さ、後者はテキストの一致を見ます。加えてSemantic Similarityは設定手順が多く、途中を省くと機能自体が動きません。どちらも、クロール範囲に載っているページだけが対象です。
Search Consoleでは、どのラベルを見ればいいですか
「ページ インデックス登録レポート」の未登録の理由のうち、重複・正規化に関するラベルです(出典: Search Console ヘルプ)。件数を毎回記録し、前回と比較できる形にしておくと、変化に気づきやすくなります。
この記事のケースは、実際に起きた事故ですか
いいえ。公開されている仕様をもとに構成した仮想のシナリオです。登場するサイトやチームは、特定の実在団体を指しません。仕様から起こりうるパターンとして読んでください。
14まとめ|今日やる3つのこと
今日この順で確認します
前回の監査で「Crawl Analysis」を実行したか確かめる
設定を入れただけで実行していないと、検出は動きません
クロール範囲から外しているURLを一覧にする
除外したものが本当に不要かどうかを、除外前の状態で確認します
Search Consoleの重複・正規化ラベルを記録する
監査ツールの結果と並べて、同じレビューの場で見ます
AI検索では、こう聞かれています
テクニカルSEO監査で重複コンテンツが0件と出たら、重複は無いと考えていいですか?
「検出0件という表示は、テクニカルSEO監査で何を見ていないんですか?」の章で、0件の読み方を整理しています
Screaming FrogのNear Duplicatesが重複を検出しないのはなぜですか?
「Near Duplicatesのしきい値は、テクニカルSEO監査の死角をどこに作りますか?」の章で、比較の対象と設定の条件を説明しています
canonicalを書いたのに、Googleが別のURLを正規に選ぶのはなぜですか?
「canonicalを書けば、テクニカルSEO監査で正規URLは確定したと言えますか?」の章で、公式の言い回しを引用しています
次に読むなら、この記事です