AI × データ分析基礎知識集 / SEOデータ分析

SEO分析の統計入門|順位別CTR・カニバリゼーション・記事の鮮度低下の読み方


Search Console のクリック・表示・順位データは、単純な平均や前年比だけで読むと判断を誤りやすいデータです。クエリ分布のロングテール、強い季節性、表示されてからクリックされる自己選択構造の3つを意識して扱う必要があります。本記事では、自社データから期待CTRを作るところから、機会損失を見つけるCTR4象限分析、キーワードカニバリゼーションの統計的検知、各記事の鮮度低下(流入劣化)の分析、コアアップデートのインパクト測定までを、初学者向けに整理します。

公開2026.05.15
最終更新2026.05.15
読了 14 分 / 約6,200字
この記事をシェアポスト
AI × データ分析SEOデータを統計的に読む

SEO分析の統計入門
CTR・カニバリ・鮮度低下

Search Console のクリック・表示・順位は、SEO分析の基礎データです。ただ、このデータは「平均」「前年比」「合計」だけで読むと判断を誤りやすい性質を持っています。クエリ分布はロングテール、流入は強い季節性、CTRは表示されてからの自己選択。3つの偏りに合わせた読み方が必要です。

C
結論
SEOデータは「自社の期待値」と「中央値」を基準に読む

SEOデータは 業界平均CTR ではなく 自社の期待CTR を、平均値ではなく 中央値 を、絶対値ではなく 期待値との差分 を基準にすると、施策の打ち所が見えやすくなります。表示回数で母集団を絞り、ロングテール・季節性・自己選択の3つの偏りを意識して扱うのが基本です。

01.まず結論:SEOデータの3つの特徴

Search Console から得られるSEOデータには、他のマーケティングデータと比べても強い特徴が3つあります。これを意識しないまま平均値や前年比で判断すると、施策の打ち所を読み違えやすくなります。

特徴中身読み方の対処
ロングテール(べき分布)クエリも記事流入も上位少数に集中し、大多数のクエリは表示数が少ない。平均値が中央値を大きく上回る平均ではなく中央値・パーセンタイル(p50/p90)で語る。表示数で母集団を絞ってから平均を取る
強い季節性週次・月次・年次の周期性が強い。BtoBは平日と土日、BtoCはキャンペーン期で動くSTL分解や同一曜日比較で季節性を除いてからトレンドを読む。YoY/MoMは祝祭日・うるう年を補正
自己選択バイアス(表示→クリック)クリックは「表示されてから選ばれた」結果。表示回数の母集団が違うと比較できない期待CTR(順位別の自社平均)を作り、実CTRとの差分を見る。表示回数の閾値で足切りする
i
平均と中央値
クエリ別クリックの『平均』はロングテールに引っ張られる

サイトのクエリ別クリック数は、上位ごく一部のクエリが大半を稼ぐべき分布を取ります。算術平均は上位の極端値に引っ張られて中央値の数倍〜十数倍になりがちで、「平均クエリのクリック数」を語ってもサイトの実態を映しません。中央値・p90・p99 のような順位ベースの指標と、母集団を表示回数 1,000 件以上などで絞った上での平均を併用するのが安全です。

02.順位別CTRと期待CTR|パレート分布の読み方

SEOで一番よく使う統計概念が 期待CTR です。検索結果の順位ごとにクリック率(CTR)は決まった傾向を持ち、上位ほど高く、順位が下がるとべき分布的に減衰します。

図:順位別CTRはべき分布で減衰する(例示)

上位3位までで全クリックの過半を取るのが一般的な傾向。値はクエリタイプ・SERP機能・ブランド要素で大きく変動するため、必ず自社のSearch Consoleデータから期待CTRを再計算する。

1位
30.0%
2位
16.0%
3位
10.0%
4位
7.0%
5位
5.0%
6位
3.5%
7位
2.5%
8位
2.0%
9位
1.5%
10位
1.2%

参考用の例示値。同じ「3位」でも、Informational クエリと Transactional クエリ、AI Overviews の有無、ブランド名を含むかどうかで実CTRは数倍の差がつく。「業界平均」ではなく「自社の」期待CTRを使うのが原則。

順位別CTRには「業界平均」と「自社平均」の2系統があります。SEOツールやリサーチ会社が公表する業界平均は参考にはなりますが、SERP(検索結果画面)には AI Overviews・強調スニペット・ショッピング枠・ローカルパックなど多くの機能枠があり、クエリタイプやブランド露出によって CTR は数倍の差がつきます。自社の Search Console データから順位別の自社平均CTRを計算し、それを期待CTRとして使う のが原則です。

手順やることポイント
01. データ抽出Search Console(または BigQuery Bulk Export)から、クエリ × 平均掲載順位 × 表示回数 × クリック数を取り出す16ヶ月の上限を超えるなら BigQuery Bulk Export を併用
02. 母集団のフィルタ表示回数が少ないクエリ(例:100 未満)はノイズが大きいので外すサンプル数の少ない順位別CTRは過大・過小になりやすい
03. 順位の丸め平均掲載順位を整数に丸める。1位、2位、…10位以下はまとめる順位は浮動小数で出るので、ビンに切る
04. 期待CTR算出順位ビンごとに「クリックの合計 / 表示の合計」を計算(クエリ単位の単純平均ではない)加重平均にすることで、表示の多いクエリの実態を反映
05. 外れ値除去クエリレベルで実CTRが期待の3倍以上のものは別建てで分析ブランド名・商標を含むクエリは別カテゴリに切る

03.CTR4象限分析|機会損失の見つけ方

期待CTRを作ったら、クエリ(またはページ)ごとに「表示回数」と「実CTR ÷ 期待CTR」の2軸で4象限に分けて読みます。打ち手の優先度が一気に整理できます。

高実CTR / 期待CTR低
強み(このまま伸ばす)
露出も多く、CTRも期待を上回る。すでにブランド・タイトル・スニペットが効いている領域
競合に劣化させられないようリンク・更新で守る
最優先:機会損失
露出は多いのに、CTRが期待を下回る。タイトル・メタディスクリプション・URL構造・構造化データで取り戻せる伸びしろが大きい
月間表示の多いページから順にタイトル・スニペット改修
次点:露出を増やす
CTRは高いが、そもそも表示が少ない。内部リンク強化・関連クエリ追加・トピッククラスタ整備で露出を増やす
刺さるタイトルを持つ記事の流入導線を強化
見直しor撤退
露出もCTRも低い。検索意図とのズレ、競合の強さ、需要そのものの薄さが原因。統合・撤退・別意図への作り直しを検討
カニバリ統合・noindex化・全面リライトのどれかを選ぶ
少表示回数(露出量)多
図:CTR4象限分析。横軸は表示回数(露出量)、縦軸は実CTRが期待CTRに対してどれだけ届いているか。
i
機会損失の試算
表示回数 × (期待CTR − 実CTR)= 見逃しクリック

「機会損失」象限のクエリは、月間の見逃しクリック数を 表示回数 ×(期待CTR − 実CTR) で見積もれます。例:月間表示 10,000 回、期待CTR 8%、実CTR 3% のクエリなら、月 500 クリックの取り逃し。これにビジネス価値(クリック単価や問い合わせ転換率)を掛ければ、リライト・スニペット改修の投資判断ができます。

04.キーワードカニバリゼーションの統計的検知

キーワードカニバリゼーションとは、同じ検索クエリに対して自社サイトの複数URLが順位に出てきて、お互いに評価を奪い合っている状態です。順位が安定せず、本来1つのページに集まるべき被リンク・滞在・クリックがバラけてしまいます。

カニバリは「目視で気づいた時には手遅れ」になりやすいので、Search Console のデータから統計的に検知できる仕組みにしておくのが安全です。代表的なシグナルは次の通りです。

シグナル意味閾値の目安
同一クエリで複数URLが上位30位に共存1つのクエリに対して、自社のURLが2件以上ランクされているURLユニーク数 ≥ 2
最高順位URLが期間内で切り替わる週ごと・月ごとに、最上位を取るURLが入れ替わる切替頻度 ≥ 2回/28日
クリックが複数URLに分散しているクリックの 100% を1つのURLが取れていない最大シェアURLのクリック比率 < 70%
両方のURLが直近で順位下落している競合に押されているのではなく、自社内で食い合っている兆候両URLの平均掲載順位がYoYで悪化
!
カニバリ判定の落とし穴
ピラー記事と詳細記事は意図的に共存していることが多い

同じクエリで複数URLが出る=即カニバリ、ではありません。ピラー記事と詳細記事、カテゴリページと記事ページは意図的に並んで上位を取りに行く設計です。同じ検索意図に対して 複数の同質ページが競合しているかどうかを、タイトル・H1・ファーストビューの内容で目視確認する一手間が必要です。

対処パターン内容向く状況
統合(Canonical / 301)弱い方のURLを強い方に301リダイレクトし、評価を集約意図がほぼ同じで、片方を残す必要がない
差別化(リライト)両方を残し、検索意図・H1・本文を意図的に分ける片方は比較・もう片方は実践、のように切り分けたい
内部リンクの集中強い方のURLへ内部リンクを集約し、弱い方への外部リンクは温存急に統合できない事情がある(営業導線・施策ページなど)
noindex化弱い方を検索結果から外すアーカイブ・古いキャンペーンなど、検索流入を狙わない場合

05.記事の鮮度低下分析|流入劣化曲線の読み方

記事の鮮度低下(英語では Content Decay)は、過去に成果を出していた記事の流入が時間とともに落ちていく現象です。検索意図のシフト・競合の参入・情報の古化・コアアップデートのいずれかが原因で、自然と気づくことが少ないため、データで定期的にスキャンする運用が向きます。

図:記事の鮮度低下(流入劣化)曲線の比較

健全な記事の中央値曲線に対して、劣化記事は途中から乖離が広がる。乖離が一定(例:中央値の50%未満)を下回り、その状態が継続したらリライト候補に入れる。

0週4週8週12週16週20週24週0255075100公開後の経過週数クリック指数(中央値=100想定)
健全な記事(中央値)劣化記事の例

個別記事の劣化を1本ずつ目視するのではなく、「公開後 N 週時点の中央値曲線」を基準に、それぞれの記事が中央値からどれくらい乖離しているかで判定します。

手順やることポイント
01. 公開からの経過週でデータを揃える全記事の公開後 N 週時点クリック数(または表示数)を、相対時間で並べ替える絶対日付ではなく「公開後 N 週」が比較軸
02. 中央値曲線を作る経過週ごとに全記事のクリック数の中央値を取り、健全な記事の参照曲線を作る平均ではなく中央値。ロングテール・ヒット記事の影響を抑える
03. 個別記事の乖離を計算各記事の現在値 ÷ 中央値曲線の同じ経過週の値、または Z スコア化比率 < 0.5 など閾値を設定。連続2期間で下回ったら劣化候補
04. CUSUM で変化点を検出累積偏差を見て「いつから劣化が始まったか」を特定コアアップデート前後との対応関係も確認できる
05. リライト優先度をスコア化劣化幅 × 月間表示 × ビジネス価値(CV単価)で並び替え「劣化しているがそもそも価値が低い記事」を上位に出さない
i
リライトと撤退の境目
検索意図そのものが変わっている記事は『リライト』ではなく『作り直し』

劣化記事の中には、検索意図そのものがシフトしてしまっているケースがあります(例:「ChatGPT 使い方」が登場当初の「ログイン方法」中心から、現在は「API・カスタムGPT・実務活用」中心へ)。タイトルと本文のマイナーチェンジでは戻らないので、SERP(上位10件)を改めて読み直し、骨格から書き直すか、別URLで作り直すかを判断します。リライトの考え方は SEO記事リライトの進め方 に整理しています。

06.季節性とコアアップデートのインパクト測定

SEOの時系列データは、季節性が強く混入します。YoY(前年同期比)・MoM(前月比)をそのまま比較すると、施策の効果ではなく季節要因を見ていることが多々あります。

補正やること向く場面
移動平均(7日・28日)日次のノイズを丸めてトレンドを読む短期の上下動を均したい
同一曜日比較今週月曜 vs 先週月曜のように、曜日を揃えて読むBtoBで平日/週末の差が大きい
STL分解時系列をトレンド・季節性・残差に分ける中長期トレンドと季節性を分けて議論したい
祝祭日・うるう年補正祝祭日テーブルを作り、その日を別フラグで扱うYoY比較の精度を上げたい

コアアップデート(Googleの順位アルゴリズムの大型更新)のインパクトを評価するときは、「アップデート前後の単純差分」では季節要因と切り分けられません。影響を受けにくい参照系列を用意して差分を取る、介入分析の考え方を取り入れます。

i
介入効果の測り方
CausalImpact 的に『介入がなかったらどうなっていたか』と比べる

まず用語を整理します。介入はコアアップデートや施策など流入を動かす出来事、参照系列はその介入の影響を受けないと考えられる別データ(ブランド指名検索・別言語サイト・別カテゴリなど)、カウンターファクトは「もし介入が起きなかった場合に推定される流入の動き」(反実仮想)です。

コアアップデートのような介入の効果を測るには、参照系列をベイズ構造時系列モデルで学習し、「アップデートがなければこれくらいの流入だったはず」というカウンターファクトを推定して、実際の流入との差を取ります。これが CausalImpact の発想です。SEO の文脈では、影響を受けないサイト内カテゴリ(ブランド指名検索など)・他の更新の影響が少ない地域・別言語サイトを参照系列にします。

やること中身注意点
01. 影響を受けにくい参照系列を選ぶブランド指名・直接アクセス・別カテゴリなど参照系列自体が更新の影響を受けないかを目視で確認
02. 介入前の関係性を学習アップデート公表前3〜6ヶ月の流入と参照系列の関係をモデル化学習期間が短いと外挿の精度が落ちる
03. 介入後のカウンターファクトを推定する参照系列の動きから「介入がなければこうなっていた」を推定推定の信頼区間も併記する
04. 観測値と差を取る実流入 − カウンターファクト=介入効果信頼区間が0をまたぐなら『差があるとは言い切れない』
05. 30/60/90日後で再評価コアアップデートは数週間揺れるので、確定値は最低でも30日後早期判定で施策を打つと、戻り局面を見誤る

07.SEO分析で陥りやすい誤り

誤り起きること対処
サイト全体の平均CTRを語るクエリの分布が違うサイト同士を平均で比較してしまう順位別・意図別の期待CTRに分解する
表示が少ないクエリの平均CTRを真に受けるサンプル数が少なく、CTRが極端値になる表示回数の閾値(例:100以上)で母集団を絞る
AI Overviews 出現でCTR下落=改悪と判定表示回数が伸びている裏で、クリック総数では変化が小さいこともあるクリック総数・CV総数で評価し、CTR単独では判定しない
前年比だけで施策の良し悪しを語る季節性・コアアップデート・SERP変化が混入STL分解・参照系列・介入分析の枠組みで切り分ける
順位下落=必ず改善が必要、と思い込む検索ボリュームそのものがなくなったキーワードまで施策対象にしてしまう順位 × 表示の両軸で評価。需要そのものが薄まっていれば撤退も選択肢
相関を因果と取り違える外部リンク数と順位の相関が高い→外部リンクを増やせば順位が上がる、とは限らないA/B テスト・因果推論で別途検証
!
自己選択バイアス
クリックされた人と、表示されただけの人は別の母集団

Search Console の CTR は「表示された中でクリックされた率」です。さらにその後、サイトに来た人の中で CV するかは別の選別が走ります。順位を上げる施策・スニペットを改善する施策・LP の CV を上げる施策は、それぞれ異なる母集団に対するアプローチで、効果を一括で評価できません。表示→クリック→セッション→CV のファネルごと に指標と母集団を分けて議論するのが安全です。

08.よくある質問(FAQ)

期待CTRは業界平均と自社平均、どちらを使うべきですか?

自社平均が原則です。業界平均はクエリタイプ・ブランド露出・AI Overviews を含む SERP 機能の有無で数倍の差がつくため、自社サイトに当てはめると過大/過小評価につながりやすくなります。Search Console の自社データから、表示回数の閾値で足切りした上で順位別の自社平均CTRを作り、それを期待CTRとして使うのが基本です。業界平均は「桁が合っているか」を確認する目安としてだけ使うようにします。

何件以上の表示があれば信頼できるCTRと言えますか?

目安として、表示回数 100〜500 件が下限です。CVR や CTR のような比率には Wilson の信頼区間を計算する方法があり、95% 信頼区間の幅が ±2〜3 ポイント以内に収まる水準を運用しきい値にすると、サンプルが少なくて極端値が出るクエリを除外できます。重要な意思決定(タイトル全面リライトなど)に使うなら、表示回数 1,000 件以上を要求するチームもあります。

カニバリゼーションは必ず統合すべきですか?

必ずではありません。ピラー記事と詳細記事、カテゴリページと記事ページは、意図的に並んで上位を取りに行く設計です。判断軸は「タイトル・H1・ファーストビューの内容が同じ検索意図に向いているか」。意図が同じで内容も重なるなら統合、意図が違うなら差別化、ピラー・詳細関係なら内部リンク集中で評価を整える、と使い分けます。即統合だけが解ではありません。

コアアップデートの効果判定は何日待つべきですか?

ロールアウト完了の Google 公表日から 30 日以上待つのが目安です。アップデート期間中は順位が日次で大きく揺れ、終了直後も戻り局面が出ます。早期に「下落=改悪」と判定して施策を打つと、戻り局面を見誤ったり、的外れな打ち手を入れたりするリスクがあります。30/60/90 日の3点で再評価し、参照系列(ブランド指名検索や別カテゴリ)から推定したカウンターファクトとの差で確定値を見るのが安全です。

AI Overviews によるCTR低下はどう判定すれば良いですか?

CTR は「表示の中での選ばれ率」なので、AI Overviews で表示回数の母集団が広がるとCTR は機械的に下がります。クリック総数とCV総数を併走させ、表示が伸びてクリック総数の落ち幅が小さければ、ビジネス上の見え方は維持されていると判定します。CTR は内部のチューニング指標、クリック総数・CV総数は外部報告指標、と整理しておくのが分かりやすい運用です。

記事の鮮度低下の分析は、どれくらいの粒度で回せば良いですか?

月次が最低ラインです。週次だとSEO データの季節性ノイズが強く出すぎ、四半期だと劣化への気づきが遅れます。月次で中央値曲線を更新して劣化候補を抽出、四半期でリライト対象を確定、年次でカテゴリ構造そのものを見直す、という3層の頻度設計が回しやすい運用です。BigQuery に Search Console を蓄積しておけば、これらの分析を SQL と Looker Studio で自動化できます。

09.まとめ

SEOデータは ロングテール・強い季節性・自己選択バイアス の3つの偏りを意識して扱う必要があります。順位別の自社期待CTRを作り、CTR4象限分析で機会損失を見つけ、カニバリゼーションは複数URLの順位・クリック分散から統計的に検知し、記事の鮮度低下は中央値曲線との乖離で判定する。コアアップデートのような介入は、影響を受けない参照系列と比較してカウンターファクトを推定し、差を取る。

どの分析にも共通するのは、平均ではなく中央値、業界平均ではなく自社の期待値、絶対値ではなく期待値との差分 で語ること。1つの指標で結論を出さず、表示・順位・CTR・クリックの4つを併走させて読むのが、SEO分析の基本姿勢です。

お問い合わせ

SEOデータ分析と分析基盤の設計をご相談ください

Search Console × BigQuery × Looker Studio の分析基盤構築、期待CTR・カニバリ検知・記事の鮮度低下分析の運用設計を伴走支援しています。お気軽にお問い合わせください。

お問い合わせはこちら

データ分析・アルゴリズム 基礎知識集

一覧に戻る →
07

モデル構築の自動化

SEO・AI検索 基礎知識集

一覧に戻る →
この記事をシェア
澤田 翔太(Shota Sawada)
この記事を書いた人

澤田 翔太

株式会社クリプタル 代表取締役

1988年生まれ、慶應義塾大学卒。創業メンバーとして関わった株式会社セールスサポートを株式会社ネオマーケティング(東証STD 4196)に売却。株式会社クリプタルでも複数の事業立ち上げと売却を経験し、2022年9月には婚活・恋愛メディア「シッテク」「婚活会議」を株式会社ベビーカレンダー(東証GRT 7363)へ売却。現在はAI業務支援事業、TANTOU事業、グロースハック支援事業、メディア事業、SEOコンサルティング事業を手がける。