ChatGPTとGoogleの引用はどう違う? 主要AI 5社を比較して見えた「AI検索対応」の共通点と差異【2026年調査】
ChatGPTやGoogleなど主要AI5社を徹底比較。引用源の違いと推奨ブランドの一致傾向から、今取るべきAI検索対応を解説。
9月1日 7:05
「AI検索対策」という言葉が、ここ1年で一気に一般的になりました。多くのWeb担当者の方は、「ChatGPTやGemini、そしてGoogleのAI Overviewsに自社を取り上げてもらうためには何をすればよいのだろうか」と頭を悩ませているのではないでしょうか。
このとき、これらをひとまとめに「生成AI」と捉えてしまいがちです。逆に、AIごとにまるで別の対策がいるのでは、と身構えてしまう方もいるかもしれません。実際のところ、生成AIは、どこまで同じで、どこから違うのでしょうか。
本調査では、AI検索対策の基本となる「引用源(情報として参照したドメイン)」と「推奨ブランド(回答内で紹介・推薦されたブランド)」の2つの側面に着目しました。Ahrefsのブランド分析機能(Brand Radar)を用い、日本国内の日本語検索ベースの標準的なプロンプト群を対象に、AI Overviews・AI Mode・Gemini・ChatGPT・Perplexityの5つの主要AIを同一条件で比較検証しています。
推奨ブランドの分析にあたっては、BtoCの5業種[注文住宅・生命保険・転職サービス・学習塾・クレジットカード]の計125ブランドを対象に言及数や順位を測定。調査してみると、「何を情報源として引用するか」はAIごとに大きく異なる一方、「どのブランドを推奨するか」はほぼ一致するという、対照的な実測データが見えてきました。
本記事では、プリンシプルで「LLMOコンサルティング」を提供する安倍が、それぞれのAIにどのような特徴や違いがあるのか、具体的なデータをもとに詳しく解説していきます。
発見1引用される情報源は、AIによって大きく異なる
まず、2つのAIが引用したドメインが、どれくらい重なっているかを比べてみました(※2)。すると、AI OverviewsとAI Modeは約79%が重なり、ほぼ同じ情報源を参照している一方、ChatGPTはどのAIとも31〜35%しか重ならず、最も独自でした。Geminiはその中間で、Google系とは45〜52%程度の重なりです。
同じ「AI検索」と一括りにされがちですが、参照している情報源は、AIによってここまで違うのです。
次に引用ドメインを以下の8タイプに分類して比較すると、その傾向はさらに明確になります。
- Google自社(検索・アプリ)【青】:Google検索の結果ページやGoogle Play、Googleマップなど、Google自身のサービス面
- SNS・動画・フォーラム【オレンジ】:YouTube、Instagram、X、TikTok、Redditなどの動画・投稿・掲示板
- UGC・ブログ・Q&A【赤】:note、アメブロなどの個人ブログや、Yahoo!知恵袋のような質問・回答サイト
- 百科・辞書【水色】:Wikipedia、コトバンク、Weblioなどの百科事典・用語辞典
- 比較・ランキングメディア【緑】:価格.com、mybest、@cosmeなど、商品・サービスを比較・ランキングする情報サイト
- EC・通販【黄色】:Amazon、楽天市場、Yahoo!ショッピングなどの通販サイト
- 公式・公的・学術・PR【紫】:企業の公式サイト、官公庁・自治体、学術機関、PR TIMESなどのプレスリリース配信
- 専門・バーティカルメディア【ピンク】:日経、ITmedia、食べログ、じゃらんなど、特定の業界・テーマに特化した専門メディア
Googleの生成AIは、自社プロパティへの依存が構造的に高い傾向がみられました。AI Modeでは、Google自社の引用率が14.8%を占め、AI Overviewsでも7.8%に達します。一方、非Google系のAIではこの比率はほぼ0%でした。
SNS・動画系の情報源【オレンジ】は、AI Overviewsでは23.3%と突出して高く、ChatGPTでは6.7%と低いです。百科事典・辞書系【水色】は、Perplexityでは18.0%で最も高く、次いでChatGPTでは17.1%でした。そして、公式・公的機関・学術・PR系【紫】といった「権威型」の情報源は、ChatGPTだけが15.3%と際立って高いです(他AIは1.9〜4.7%)。
引用源の偏りにも違いが見られました。上位10ドメインが引用全体に占める割合は、AI Overviews・AI Modeが約50%と高く、引用先が一部のドメインに集中する傾向がありました。一方、ChatGPTは32.6%と最も低く、より幅広いドメインを引用していることがわかります。
なお、Geminiは引用そのものの絶対量が最も少なく、引用リンクを付けずに回答するケースが相対的に多くありました。ここは、後述する推奨の傾向とあわせて見ると、興味深い点だと言えそうです。
発見2推奨されるブランドはAIが違ってもよく似ている
次に、5つのAIが、各業種で「どのブランドをどの順で推すか」の一致度を、順位ベースの相関係数で見てみます。これは、ブランドを推奨の多い順に並べたときの順位が、2つのAIでどれだけ一致するかを−1〜1で表すもので、1に近いほど同じ順位で推していることを意味します。すると、5業種すべてで相関係数は0.82〜0.98と、非常に高い水準に収まりました。
- クレジットカード:0.98
- 注文住宅:0.95
- 学習塾:0.91
- 生命保険:0.91
- 転職サービス:0.82
その傾向は、最多推奨ブランドを見ても確認できました。5業種のうち3業種では、最も多く推奨されたブランドが全AIで完全に一致しています。残る2業種も、上位2ブランドが僅差で入れ替わる程度で、上位に並ぶブランドはどのAIでも変わりません。引用源がバラバラだったにもかかわらず、推奨ブランドはAI間で非常に一致していました。情報の集め方は違えど、たどり着く「おすすめ」の結論は、どのAIでもよく似た結果となっているのです。
もうひとつ見えたのは、推奨の集中度は、AIではなく業種で決まるという傾向です。上位3ブランドが推奨全体に占める割合は、クレジットカード(58〜62%)や転職サービス(66〜73%)では高く寡占的であった一方、生命保険(35〜43%)や注文住宅(39〜46%)では低く分散的でした。
そして重要なのは、同じ業種のなかでは、この集中度がおおむね近い値に収まっている点です(後述するChatGPTの転職サービスなど、一部に例外はあります)。
つまり、「AIの推奨が一部ブランドに偏るか、広く分散するか」は、AIの種類ではなく、その市場の構造を映している可能性が高い訳です。これは実務的にも示唆に富む点だと考えています。
発見3唯一の例外はChatGPT──引用でも推奨でも、最も独自の動きをする
ChatGPTでは、他AIと比べて次のような違いが見られました。
- 注文住宅では、他AIとは異なるブランドが最多推奨となった
- 学習塾でも、最多推奨ブランドが他AIと異なった
- 転職サービスでは相関係数が最も低く(0.82)、差の多くはChatGPTの挙動による
- 転職サービスでは上位3ブランドへで約87%と、他AI(66〜73%)より高かった
ここで思い出していただきたいのが、発見1です。引用源の面でも、ChatGPTはどのAIとも重なりが最も小さく(31〜35%)、権威型の情報源に最も寄り、引用先も最も分散していました。
引用でも推奨でも、ChatGPTだけが一貫して独自の傾向を示しています。他のAI、とりわけGoogle系の3つが比較的似通った動きを見せるなかで、ChatGPTは情報の入口から出口まで、異なるロジックで動いているように見えます。
今回の比較では、推奨ブランドはAI間でよく一致した一方、引用源には大きな違いが見られました。特にChatGPTは、引用・推奨の両面で他AIとは異なる傾向を示しています。
調査結果から考えるAI検索対策
ここからは、今回の調査結果をもとに、AI検索対策で参考になりそうなポイントを整理します。ただし、AIの内部仕様は公開されていないため、ここで紹介する内容は断定ではなく、調査結果から読み取れる傾向としてご覧ください。
引用されやすい情報源は、AIによって異なる
引用される情報源がAIによって大きく異なること(発見1)が示すのは、「引用されやすい情報源」の傾向がAIで大きく異なるということです。
SNS・動画が引用されやすいAIもあれば、公式・権威型が引用されやすいAIもあり、Googleの生成AIでは自社エコシステムの比重が高い傾向がみられます。取り組むべきことの本質(信頼される一次情報を地道に積み上げること)は、どのAIでも大きくは変わらないと考えています。ただ、同じ情報発信でも、どのAIで引用されやすいかには差が出ることを理解しておくことが、露出の見立てに役立つと考えられます。
推奨の土台は、AIをまたいで共通しやすい
一方で「推奨されるブランド」は、AIが違ってもほぼ一致するという点(発見2)は、「どのブランドが推されるか」がAI間で似通うことを示しています。これは、特定のAIだけを狙い撃ちするより、ブランドとしての基礎的な存在感(指名・言及の蓄積)を高めることが、結果的にどのAIにも波及しやすい可能性を示唆しています。推奨の面では、AI別の個別最適よりも、土台づくりの効果が広く及ぶ、という見方ができそうです。
自社の業種が「寡占型」か「分散型」かを把握する
発見2で示した「集中度が業種で決まる」という傾向は、目標設定にそのまま関わります。上位数ブランドで推奨の大半を占める寡占型の業種と、広く分散する業種とでは、AIに取り上げられるまでの難易度が異なります。自社の業種がどちらのタイプかを、まず定量的に把握しておくことが、現実的な優先順位づけの出発点になると考えています。
調査の概要
目的
本調査の目的は、生成AIごとの「引用源」と「推奨ブランド」の違いを定量的に比較し、AI検索対策を考えるうえで、AIごとにどのような違いがあるのかを明らかにすることです。「引用されること」と「推奨されること」は混同されがちですが、本来は異なる現象です。引用源はAIが回答を組み立てる際に参照した情報を示しており、推奨ブランドは回答の中で実際に紹介・推薦されたブランドを示します。
そこで今回は、AI Overviews・AI Mode・Gemini・ChatGPT・Perplexityの5つを同じ条件で比較し、「引用源」と「推奨ブランド」の両面から、それぞれのAIにどのような特徴があるのかを調査しました。
調査の対象
- 対象AI:AI Overviews、AI Mode、Gemini、ChatGPT、Perplexity
- 地域・言語:日本、日本語の検索ベースのプロンプト
- 取得指標:引用(引用ドメイン)と推奨(メンション=ブランド名の言及数)
- 使用ツール:Ahrefsのブランド分析機能(Brand Radar)
調査方法
Ahrefsが日本向けに保有している、検索ベースの標準的なプロンプト群(※1)を用い、AI Overviews・AI Mode・Gemini・ChatGPT・Perplexityの5つのAIについて回答を取得しました。同一のプロンプト群を用いることで、各AIを同条件で比較しています。また本調査では、各AIの傾向を比較することを目的として、下記の範囲で分析しました。
引用源の分析
各AIの回答から引用ドメインを抽出し、引用回数の多い上位100ドメインを対象に分析しました。ドメイン種別(公式サイト・メディア・SNS・動画・百科事典など)の構成比やAI間の重複率、引用の偏りを比較しています。
推奨ブランドの分析
消費者向けの5業種(注文住宅・生命保険・転職サービス・学習塾・クレジットカード)、各25ブランド・計125ブランドを対象に、AIごとの推定メンション数(ブランド名が言及された回数)を取得しました。この125ブランドが、各業種・各AIで、どのくらいの頻度で、どの順に推奨されるかを比較しています。
調査の限界
今回の調査には、いくつかの限界があるため、ここに開示しておきます。
- 相関・一致は、因果を意味しません。 「推奨がAI間で一致する」「集中度が業種で決まる」といった内容は、あくまで観測された傾向です。その背後にある仕組み(たとえば各AIが共通の学習データや共通のWeb上の評判を参照している可能性など)を、因果として証明したものではありません。
- 対象範囲は限定的です。 引用源は各AIで引用が多かった100ドメイン、推奨は消費者向け5業種・125ブランドという範囲での測定です。他業種・他ブランドにそのまま一般化できるとは限りません。
- 時点性の影響があります。 本調査は2026年7月時点のデータに基づきます。AIモデルも、それを計測するツールの仕様も、短期間で変化します。(実際、今回の調査期間の直前まで、Googleの生成AIについては引用URL自体が取得できませんでしたが、いまは取得可能になっています。)数か月単位で状況が変わる領域であることは、前提として押さえておく必要があります。
- 数値は推定値であり、名称マッチングの限界もあります。 メンション数はツール側の推定値です。また、ブランド名に一般的な英単語が含まれるケースでは、無関係な言及を拾ってしまうため、そうしたブランドは分析から除外しています。
これらの限界を踏まえてもなお、5つのAIを同一条件で横断比較し、「入口はばらつき、出口は揃う」という非対称を定量的に示せたことには、手応えを感じています。今後もデータの蓄積と検証を続けていきたいと考えています。
まとめ
本調査で見えてきたことを整理します。
- 引用源はAIによって大きく異なる
- 推奨ブランドはどのAIでもほぼ一致する
- 集中度は業種で決まる
- ChatGPTは引用・推奨の両面で独自性が見られた
今回の調査では、推奨されるブランドにはAIをまたいだ共通性が見られる一方、引用される情報源にはAIごとの違いがあることがわかりました。どのAIに対しても取り組みの本質は変わらないとしても、この推奨と引用の違いを理解しておくことが、これからのAI検索対策の土台になるのではないかと考えています。
- プリンシプルの「LLMOコンサルティング」はこちら
注
※1 Ahrefsの標準プロンプト群について :Ahrefsが用意している、AIに投げる標準的な質問(プロンプト)の集合です。各国で収集している検索キーワードのデータをもとに構成されており、ユーザーが生成AIに尋ねそうな幅広いテーマを含みます。この共通の質問群を5つのAIすべてに同じ条件で投げることで、AI間の回答を横並びで比較できます。
※2 「重複率」について :2つのAIが引用したドメインの集合が、どれだけ重なっているかを表す割合です。統計的には、集合の重なりを測るJaccard係数を百分率にしたもので、100%に近いほど、2つのAIが同じドメインを引用していることを意味します。
