MENU
  • HOME
  • お問い合わせ
  • 集客オプション
売れるサイトは、みな謙虚。お客様を主役にするWEB集客コンサルティング
合同会社謙虚
  • HOME
  • お問い合わせ
  • 集客オプション
  • HOME
  • お問い合わせ
  • 集客オプション
合同会社謙虚
  • HOME
  • お問い合わせ
  • 集客オプション
  1. ホーム
  2. LLMO
  3. LLMO論文
  4. 【LLMO論文解説】GoogleのAI Overviewsは、どんな検索で出て、出典どおりに書いているのか|55,393件を40日間追った実測調査(プレプリント・査読中)

【LLMO論文解説】GoogleのAI Overviewsは、どんな検索で出て、出典どおりに書いているのか|55,393件を40日間追った実測調査(プレプリント・査読中)

2026 9/22
GoogleのAI Overviewsは、どんな検索で出て、

GoogleのAI Overviews(検索結果の上に出るAIの要約回答)は、世界で20億人以上が目にしていると、Google自身が説明しています。では、その回答は、どんな検索で出て、どんなページを出典にして、書かれた内容は出典どおりなのでしょうか。この問いを、55,393件の検索を40日間くり返し実測して調べた論文が、2026年5月13日にarXivで公開されました。

この記事は、その論文を原文から読み、要点を整理します。サーベイ論文を解説した記事では、この論文が「98,020件の主張のうち約11%が根拠不十分」と紹介されていました。この数字が原文とどう対応するのか、11%の中身は何なのかも、原文の表で確かめました。数値は、論文が報告している値をそのまま拾っています。

合同会社謙虚は、3つのドメインを並行して運用し、何を変えると数字が動くかを測り続けています。この論文は、AIの回答が「どんな質問で出て、何を根拠にして、どれだけ正しく書かれているか」を大規模に測った例で、自社ページの見え方を考える前提になります。

目次

結論:3行で言うと

  • AI Overviewsが出た検索は、この論文が集めた急上昇クエリ全体で13.7%でした。疑問文の検索では64.7%、疑問文でない検索では9.5%と、質問の形で大きく差がつきました
  • 出典に選ばれたサイトは、同じ画面の通常の検索結果より、信頼性の評価が平均で高めでした。ところが出典ドメインの29.8%は、通常の検索結果の1ページ目にありませんでした。AIの出典選びは、検索順位とは別の仕組みで動いています
  • 回答を98,020件の小さな主張に分けて出典と照合すると、約89%は出典で裏づけられ、約11%は裏づけられませんでした。多くは「出典のどこにも書いていない」ケースで、AIによる自動判定で、論文自身が上限に近い値として読むよう求めています

この論文の基本情報

項目 内容
原題 Measuring Google AI Overviews: Activation, Source Quality, Claim Fidelity, and Publisher Impact
著者 Haofei Xu、Umar Iqbal、Jacob M. Montgomery(3人。ワシントン大学セントルイス校)
公開 2026年5月13日(v1)。arXiv:2605.14021、分野はcs.CY(コンピュータと社会)
掲載・採択の状況 arXivのコメント欄は「Under Review」(査読中)。学会・論文誌に採択された表示は、確認した時点でありませんでした
種類 実測研究(Googleの画面を自動で集めて数える調査)。実験で条件を変えた研究とは違います
調査期間 2026年3月13日〜4月21日(40日間)
データ・コードの公開先 原文には公開先の記載を見つけられませんでした

論文はこちらで読めます。arXiv(2605.14021)、arXiv発行のDOI。

この論文が答えた問い

GoogleのAI Overviewsは、どんな検索で出て、どんなサイトを出典にして、書いた内容は出典で裏づけられているのか。そして、出典にされたページの側には、どんな収益の仕組みがあるのか。

Googleは、AI Overviewsを「上位の検索結果に裏づけられた情報を出すもの」と説明し、他のAIのような作り話は起きにくいとも述べています。論文は、この説明を外から確かめられるかを、4つの問いに分けました。

  1. 出る頻度:どんな検索で出るのか
  2. 出典の質:引用されるサイトは信頼できるのか。通常の検索結果と重なるのか
  3. 主張の裏づけ:書かれた内容は、出典に本当に書いてあるのか
  4. 出版社への影響:出典にされたページは、広告収入に頼っているのか

どうやって調べたのか

項目 内容
検索に使った語 Googleトレンド(米国版)の急上昇クエリ。19の分野を24時間ごとに巡回し、40日間で55,393件
集め方 自動操作のブラウザで、ログインも履歴もない新しい状態から検索。AI Overviewsの全文、出典リンク、1ページ目の検索結果を記録(米国東部のサーバーから実行)
AI Overviewsが出た件数 7,583件(55,393件の13.7%)。出典リンクは合計61,212件
出典の信頼性 ニュース系ドメインの信頼性を専門家や一般の評価から0〜1点にまとめた既存の指標(PC1)。たとえばロイターは1.000、ニューヨーク・タイムズは0.859、フェイスブックは0.407
主張の裏づけ 回答を「1つの事実だけ」の小さな主張に分け、出典ページの本文と照らして5段階に分類。分類はAI(Grok 4.1 Fast Reasoning)が行い、人手の判定と比べて精度を確認
広告の有無 出典ページの中に、広告ブロック用のルール集(EasyList)に当てはまる広告枠があるかを判定

「疑問文の検索」は、先頭の単語が15語の疑問詞(who、what、how、isなど)のどれかである検索と定義されています。英語の検索が対象です。

結果

どんな検索でAI Overviewsが出たか

切り口 AI Overviewsが出た割合 備考
全体 13.7%(7,583件/55,393件) 日ごとの割合は大きく動かず、大きな行事の日に増加
疑問文の検索 64.7%(2,716件/4,198件) how 84.3%、why 73.4%、when 72.6%、who 47.9%、did 39.8%
疑問文でない検索 9.5%(4,867件/51,195件) 疑問文との差は約6.8倍
疑問文でない検索を語数で分けると 1語 9.9%、2語 3.4%、4語 17.0%、6語以上 38.7% 長い検索ほど出やすい
分野別の最低 美容・ファッション 3.5% 分野で約13倍の差
分野別の最高 趣味・余暇 46.1%、科学 39.9% 政治 7.5%、法律・行政 9.6%は低め
  • 13.7%は、この40日間の急上昇クエリの割合です。全体の51.4%(28,446件)がスポーツで、そこでの割合は9.8%でした。あらゆる検索での出現率という意味には読めません
  • 健康は26.6%で、平均より高めでした。慎重に扱うはずの分野でも一律には抑えられていないことになります。論文は、抑える基準をGoogleが公表していない点を指摘しています

どんなサイトが出典になったか

  • 1つのAI Overviewsあたりの出典は中央値8件(最大32件)で、7,479のドメインにばらけていました。多く引用されたのは、YouTube(5.49%)、ウィキペディア(4.39%)、フェイスブック(3.68%)、インスタグラム(3.65%)、USAトゥデイ(2.80%)です
  • 信頼性の平均は、AI Overviewsの出典が0.732、同じ画面の1ページ目の検索結果が0.645で、差は+0.087でした。SNSなど一般の投稿が中心のサイトの割合も、出典では14.2%、1ページ目では41.4%でした
  • AI Overviewsの出典ドメインのうち、1ページ目の検索結果に出ていたのは70.2%です。上位5件に限ると25.0%、上位10件で41.4%でした。残りの29.8%は、1ページ目のどこにも見当たりませんでした。この1ページ目にないものの信頼性は、平均0.758と低くありませんでした

論文は、通常の検索結果とAI Overviewsで、出典を選ぶ基準が異なると結論づけています。以前の研究が「AIの出典は質が低い」と述べていたことについては、この調査では逆の結果になったと書いています。

回答は出典で裏づけられていたか

7,491件のAI Overviewsから、98,020件の主張を取り出して判定しました。

判定 意味 件数 割合
明確(Clear) 出典にそのまま書いてある 82,933 84.6%
広めの表現で裏づけ(Vague) 出典に、より広い言い方で書いてある 4,271 4.4%
出典どうしが食い違う(Ambiguous) 出典の間で言うことが違う 1,367 1.4%
矛盾(Incorrect) 出典が主張と反対のことを書いている 2,609 2.7%
記載なし(Omitted) どの出典にも書かれていない 6,840 7.0%
裏づけあり(明確+広めの表現) 87,204 89.0%
裏づけなし(残りの3つ) 10,816 11.0%
  • サーベイ記事の「約11%」は、原文の11.0%(10,816件)と一致します。ただし、これは「誤り」の割合とは別の数字です。出典と反対のことを書いていたのは2.7%で、多くを占めるのは、出典に書いていない主張(7.0%)です。論文は、記載なしが矛盾の約2.6倍だと述べています
  • 1件のAI Overviewsで見ると、主張の93.33%が裏づけられているのが中央値でした。すべて裏づけられているのは41.9%(3,141件)、半分未満なのは2.74%(205件)です
  • 分野別では、健康が94.77%、政治が93.65%と高く、仕事・教育は76.85%でした。天気の分野の裏づけ率は48.2%と低く出ていますが、天気や休校情報のような刻々と変わる数字を、数時間から数日後に確認したために、出典との食い違いに見えたのだと論文は説明しています。この種の質問を除くと、19分野のうち18分野は85.9〜94.8%に収まったそうです

出版社への影響の指標は、何を数えているのか

ここは誤解しやすい点なので、平易に言い直します。この論文が「出版社への影響」として数えたのは、AI Overviewsが出典にした61,212件のページのうち、表示広告が載っているページの割合です。広告が載っているページの収入は、読者が訪れて初めて生まれます。AIの要約で満足した読者がクリックしなければ、その収入が減ると考えられます。

論文は、実際にアクセスや売上が減った量は測っていません。「トラフィックの減少そのものは測っていない」と、原文にも書かれています。

数えたもの 結果 読み方
出典ページのうち、広告が載っていた割合 50.63%(30,994件/61,212件) 半分をわずかに超える程度。原文の本文は「少なくとも」を付けた下限値としている
広告の有無を調べなかった出典 14.2%(8,688件) SNSや動画サイトは、読み取れないため「広告なし」として数えた
広告の割合が高い分野 趣味・余暇 63.14%、スポーツ 60.19%、エンタメ 55.50% 健康 27.77%、旅行 27.24%は低いが、会員制などで収益を得ている可能性がある
AI Overviewsの画面にGoogleの検索広告も出た割合 2.16%(164件/7,583件)。AI Overviewsより上に出たのは0.51%(39件) 商品購入を探す検索が少ない標本のため、少なめに出る可能性があると論文は述べている

クリックが減ったという数字(38%減、15%減)は、この論文が測ったものではなく、他の研究の結果を引用したものです。

論文自身が書いている限界

  • 広告の割合は、SNSや動画サイトを「広告なし」と数えているため、実際より低く出る下限値だと書いています
  • 裏づけの判定は、出典ページを調査の時点で取得して行っています。AI Overviewsが作られた時点の内容と違う場合があり、天気や休校のような更新の速い情報では、食い違いが実際より多く出ます。論文は、記載なしと矛盾を足した9.64%を「保守的な上限」と読むよう求めています
  • 出典にSNSなどを含むAI Overviewsでは、その部分を読めていません。裏づけなしの主張の59.9%が、こうしたAI Overviewsに含まれていました。仮にそれらがすべて裏づけられていたとしても、裏づけなしの割合は約5.3%(11.0%から下がった値)で、それより下がらない部分が残ると書いています
  • 調べたのはAI Overviewsの中身と出典です。読者がその内容を信じたか、クリックしたかは調べていません
  • ユーザーの属性、パーソナライズ、地域による違いは調べていません
  • 2026年3〜4月の40日間の1回の調査です。Googleの仕様は変わり続けます

原文を読んで気づいた点

  • 査読の状況:arXivのコメント欄は「Under Review」です。この記事の時点では、査読を通ったプレプリントではありません。今後、採択の段階で数字が変わる可能性があります
  • 日本語の検証はありません。検索は米国の急上昇クエリで、米国のサーバーから実行されています。疑問文の定義も英語の疑問詞に基づいています。日本語の検索でも同じ割合になるかは、この論文からは分かりません
  • 判定はAIによる自動採点です。裏づけの判定はAI(Grok 4.1 Fast Reasoning)が行い、人手の判定と比べて、100件中98件が一致し、重みを付けた全体の精度は95.6%でした。この確認は、5つの判定を20件ずつ抜き出した100件に基づいており、全体を人手で見たわけではありません
  • 「独立している」という読み方に注意が必要です。出典の質と裏づけ率の相関は約0.045と低いものの、分野ごとの起動率と裏づけ率の相関(0.313)は、p値が0.192で、有意といえる水準ではありません。19分野という少ない数で見た値です。「独立している」の根拠は弱めです
  • 要旨の表現が本文より強めです。要旨は、広告の載った出典が「半分を大きく超える(well over half)」と書いていますが、本文と表は50.63%(「少なくとも50.6%」)です。この記事は本文と表の値を使いました
  • 要旨の「Googleの検索広告が同じ画面に出続ける」という書き方に対し、AI Overviewsのある画面で検索広告も出たのは2.16%でした。多くの画面では出ていないので、この点は数字を見て読む必要があります
  • 信頼性の指標が対象にするのは、主にニュース系ドメインです。企業の自社サイトなどは、点数が付かないものが多く含まれます(点数が付いた出典は60.5%)。中小企業のサイトが、この点数でどう評価されるかは、この論文から分かりません
  • 本文の4.3節に「98,098件の主張」、表1と他の箇所に「98,020件」と書かれています。前者は抽出した主張の合計、後者は判定できたAI Overviewsの主張の数と読めます。差は78件で、原文に説明はありません
  • データやコードの公開先は、原文に書かれていません。第三者が数字を検算できる状態かどうかは、確認できませんでした

この論文から、言えること・言えないこと

言えること(この調査の範囲) 言えないこと
米国の急上昇クエリでは、疑問文の検索でAI Overviewsが出やすい 日本語の検索で、同じ割合でAI Overviewsが出る
出典に選ばれたサイトは、1ページ目の結果より信頼性の点数が高めだった 自社サイトが出典に選ばれる方法
出典の約3割は、1ページ目の検索結果に出ていないドメインだった 検索順位が低いほど、AIに引用されやすい
AIが作った主張の約11%は、出典で裏づけを確認できなかった AI Overviewsの11%が誤りである。あるいは、この割合が今も同じである
出典の半分強に広告が載っている AI Overviewsが出版社の売上を、何%減らしたか

中小企業の視点で、どう受け取るか

ここからは論文の主張とは別の、私の読み取りです。

  • 質問の形のページは、出番が増える側にあります。疑問文の検索で64.7%と高かったので、お客様の疑問を見出しにして答えるページは、AI Overviewsの土俵に近いと私は読みました。ただし、出るかどうかと、自社が引用されるかは別の話です。日本語での確認も残っています
  • 検索順位が高くなくても、引用される可能性があります。出典の29.8%が1ページ目の外にあったので、順位の外側にも入口があると読めます。順位だけを見て諦める必要はなさそうです
  • ページに書いた内容を、AIが正しく読み取れる形にしておくことが大切です。「記載なし」が約7%を占めていたので、AIはページに書かれていない内容を補って書くことがあります。料金、対応地域、営業時間など、聞かれやすい情報はページに明記しておくと、勘違いを減らせると考えます(これは私の推測で、論文が示した対策ではありません)
  • ときどき、自社名で検索して、AIの回答と出典を突き合わせてください。回答が出典どおりでないケースは、11%前後あると報告されています。自社に関する回答がずれていたら、出典ページの書き方を見直す手がかりになります

自社での確認の仕方は、GEO対策の効果測定の記事にまとめています。

よくある質問

AI Overviewsが出る確率は13.7%と考えてよいのですか

13.7%は、この論文が集めた急上昇クエリでの値で、半分以上がスポーツでした。疑問文なら64.7%、疑問文でなければ9.5%と、質問の形で大きく変わります。自社に関係する検索の割合は、この数字からは分かりません。

11%は、AIが間違えた割合という意味ですか

間違えた割合とは限りません。11%の中身は、出典どうしの食い違い1.4%、出典との矛盾2.7%、出典に書いていない主張7.0%です。天気のように刻々と変わる情報が、実際より多く食い違いに見える点も、論文自身が認めています。

「出版社への影響」は、アクセスが減ったという結果ですか

いいえ。この論文が数えたのは、出典にされたページのうち広告が載っている割合(50.63%)です。アクセスの減少は測っていません。クリックの減少は、他の研究の結果を引用しています。

まとめ:今日できる1つのこと

お客様がよく聞く質問を1つ選び、その質問文のまま、Googleで検索してみてください。AI Overviewsが出たら、その回答と出典を横に並べ、自社の情報が正しく書かれているかを見ます。出ていない場合も、それを記録に残します。1回の結果より、日をあけて記録した結果のほうが、判断の材料になります。

この論文は、LLMO論文の一覧の一本です。ほかの論文の解説も、順次公開しています。

この記事に書いたことを、そのまま御社のページに

生成AIに引用されるページを、お話しいただくだけでお作りします。お時間をいただくのは初回15分のヒアリングだけです。まず1ページ、無料でお作りします。

OKが出るまで、何度でも直します。事実が違う、言い回しが硬い、この話は入れないでほしい。どれも遠慮なくおっしゃってください。何度お直ししても、追加の料金はいただきません。

これまでに127社にご利用いただきました。毎月ご依頼いただいている方の6割以上が、月10ページを選ばれています。料金はページに掲載しています。

まず1ページ、無料で作らせてください

ページを増やしても問い合わせが来ないなら、原因はページの外にあります。その場合は、下の入口からご相談ください。

自社のマーケティング課題を根本から解決しませんか?

ウェブサイトから要素を引き算し、訪れた人が迷わず次の一歩に進む形へ組み直す。初回60分のオンラインで御社のサイトを一緒に読み、どこから直すべきかをお伝えします。手順をまとめた無料の診断と解説動画もご用意しています。

まず動画で詳しく見る(約30分)
無料診断を受ける

初回は無料・60分・オンライン完結・その場で契約のお願いはいたしません

LLMO論文
SEO対策 生成AI
よかったらシェアしてね!
  • URLをコピーしました!
  • 【LLMO論文解説】通常のGoogle・AI Overviews・Geminiは、引用する出典がほとんど重ならない|1万1,500問で比べた実測(SIGIR 2026)
  • 【LLMO論文解説】AI Overviewsの出典は検索上位と別物か|4,706問で見た重なりと不安定さ(Findings of ACL 2026)

この記事を書いた人

中野輝規のアバター 中野輝規

合同会社謙虚 代表社員。20代から、売る言葉だけを仕事にしてきました。電話営業で受話器を握っていた時代から、数千社のWEB集客に関わったいままで。詳しいプロフィールはこちら

この著者の記事一覧へ

関連記事

  • 通常のGoogle・AI Overviews・Geminiは
    【LLMO論文解説】通常のGoogle・AI Overviews・Geminiは、引用する出典がほとんど重ならない|1万1,500問で比べた実測(SIGIR 2026)
  • AI Overviewsの出典は検索上位と別物か
    【LLMO論文解説】AI Overviewsの出典は検索上位と別物か|4,706問で見た重なりと不安定さ(Findings of ACL 2026)
  • AIが2つのページから先に引用する方を選ぶ条件を25万2千回
    【LLMO論文解説】AIが2つのページから先に引用する方を選ぶ条件を25万2千回の実験で調べた論文を原文から読む|関連性・位置・価格・日付(SIGIR 2026)
  • ChatGPT流入の伸びは施策の効果か、成長の追い風か
    【LLMO論文解説】ChatGPT流入の伸びは施策の効果か、成長の追い風か|対照ページで切り分けた1サイト分析(プレプリント)
  • AI検索の見え方は1回の測定では決められない:4サービス45
    【LLMO論文解説】AI検索の見え方は1回の測定では決められない:4サービス45日間の追跡と、繰り返し測定の提案|スイスの小規模研究(プレプリント2026)
  • AI検索で「引用された」と「回答に使われた」は別物
    【LLMO論文解説】AI検索で「引用された」と「回答に使われた」は別物|選択と吸収を分けて測る枠組み(プレプリント)
  • AI検索は第三者の媒体を選びやすいのか、Googleと4つの
    【LLMO論文解説】AI検索は第三者の媒体を選びやすいのか、Googleと複数のAIを比べた実験を原文から読む|獲得メディアの偏りと限界(プレプリント)
  • GEO研究の批判的サーベイ
    【LLMO論文解説】GEO研究45本の批判的サーベイ|「効く」と「効かない」の境目を整理した論文(2026年7月)
最近の投稿
  • 【LLMO論文解説】AI Overviewsの出典は検索上位と別物か|4,706問で見た重なりと不安定さ(Findings of ACL 2026)
  • 【LLMO論文解説】GoogleのAI Overviewsは、どんな検索で出て、出典どおりに書いているのか|55,393件を40日間追った実測調査(プレプリント・査読中)
  • 【LLMO論文解説】通常のGoogle・AI Overviews・Geminiは、引用する出典がほとんど重ならない|1万1,500問で比べた実測(SIGIR 2026)
  • 【LLMO論文解説】AIが2つのページから先に引用する方を選ぶ条件を25万2千回の実験で調べた論文を原文から読む|関連性・位置・価格・日付(SIGIR 2026)
  • 【LLMO論文解説】AI検索で「引用された」と「回答に使われた」は別物|選択と吸収を分けて測る枠組み(プレプリント)
最近のコメント
  • 【LLMO論文解説】AIが2つのページから先に引用する方を選ぶ条件を25万2千回の実験で調べた論文を原文から読む|関連性・位置・価格・日付(SIGIR 2026) に 【LLMO論文解説】海外のGEO・LLMO論文92本の一覧|原論文から最新研究まで、テーマ別に整理(随時更新) - 合同会社謙虚 より
  • 【LLMO論文解説】GEO研究45本の批判的サーベイ|「効く」と「効かない」の境目を整理した論文(2026年7月) に 【LLMO論文解説】AI Overviewsの出典は検索上位と別物か|4,706問で見た重なりと不安定さ(Findings of ACL 2026) - 合同会社謙虚 より
  • 【LLMO論文解説】海外のGEO・LLMO論文92本の一覧|原論文から最新研究まで、テーマ別に整理(随時更新) に 【LLMO論文解説】AI Overviewsの出典は検索上位と別物か|4,706問で見た重なりと不安定さ(Findings of ACL 2026) - 合同会社謙虚 より
  • GEO対策の効果測定はなぜ難しいのか:中小企業が追うべきKPIとタイムライン に 【LLMO論文解説】GoogleのAI Overviewsは、どんな検索で出て、出典どおりに書いているのか|55,393件を40日間追った実測調査(プレプリント・査読中) - 合同会社謙虚 より
  • 【LLMO論文解説】GEO研究45本の批判的サーベイ|「効く」と「効かない」の境目を整理した論文(2026年7月) に 【LLMO論文解説】GoogleのAI Overviewsは、どんな検索で出て、出典どおりに書いているのか|55,393件を40日間追った実測調査(プレプリント・査読中) - 合同会社謙虚 より
  • HOME
  • 合同会社謙虚とは
  • 集客オプション
  • ブログ
  • お問い合わせ
  • プライバシーポリシー
  • 特定商取引法に基づく表記

© 合同会社謙虚

目次