【2026年9月19日の訂正】調査のサンプル数の書き方(153件の内訳)、算出方法が公開されていない数値の扱い、因果に寄せた表現、ChatGPTと収集期間の記述を訂正しました。
この連載ではこれまで、AIがどのページを引用するかを決める要因を、事実の正確さや文章の構成といった「中身」の観点から見てきた。しかし、その中身を評価してもらう以前の段階で、そもそも土俵に上がれるかどうかを決めている、もっと根本的な条件があるとしたらどうだろうか。ウェブサイト翻訳ツールを提供する企業が130万件超のAI検索の引用データを分析した調査は、その条件が「言語」だと指摘している。
先に断っておくと、この調査の発表元は翻訳ツールを販売する当事者であり、「翻訳すると成果が出る」という結論が自社の商材を後押しする構造にある。数字の読み方には、その分の割り引きが要る。以下では、数値そのものより、そこから読み取れる構造のほうに重心を置いて整理する。
130万件の引用データが示した「翻訳ゼロ」の代償
調査では、AI OverviewsとChatGPTにまたがる130万件超の引用が分析されている。まず、英語版を持たない高流入のスペイン語サイト153件(スペイン98件、メキシコ55件)のうち、スペインの98件について、スペイン語での検索と同じ内容の英語での検索を比較したところ、スペイン語クエリでは17,094件の引用を獲得したのに対し、英語での検索では2,810件にとどまった。調査はこの差を431%と報じている(算出方法は公開ページに明示されておらず、こちらでは再現できなかった。単純な比では約6.1倍にあたる)。
続いて、スペイン語と英語の両方のページを持つサイト83件を比較対象に加えると、様相は一変した。スペイン語での引用10,046件に対し英語での引用は8,048件で、差は22%まで縮まった。調査は、翻訳済みのサイト群では英語検索での可視性が最大327%高かったとしている(別のサイト群どうしの比較で、算出方法は公開ページに明示されていない)。
翻訳は新しい言語だけでなく、元の言語の評価も押し上げる
興味深いのは、翻訳済みのサイト群では、新しく追加した言語だけでなく、元の言語でも引用が多かった点だ。翻訳済みのサイトは、両言語を合計した引用数でも翻訳していないサイトより24%多く引用されており、元のスペイン語コンテンツだけを見ても16%増加していた。調査の発表元は、複数の言語で情報が存在すること自体が、AIに対して網羅的で信頼できる情報源という印象を与えているためだと推測している。ただし、これは相関から導いた解釈であり、因果関係が検証されたわけではない。多言語化に手が回る企業ほど、そもそも情報発信の体制が整っているという可能性も残る。
AI検索エンジンごとに「言語への厳しさ」が違う
言語をどれだけ重視するかは、AI検索エンジンによって差がある。もっとも言語に厳格だったのはAI Overviewsで、メキシコ市場を想定した検証では引用の96%がスペイン語のソースから選ばれ、スペイン語の選択肢がある場面では英語のソースが上位5件からほぼ排除されていた。一方、同じGoogleの検索基盤であるAI Modeは、1クエリあたりの引用元がAI Overviewsよりおよそ3割多く、そのぶん言語への縛りはやや緩く、スペイン語ソースの比率は93%だった。両者が同じクエリで引用したソースが重なっていたのは、55%にとどまる。同じ会社の似た機能でも、内部ではそれぞれ別の論理で動いていることになる。
ChatGPTはさらに異なる挙動を示した。ユーザーが母語で質問すると、英語と母語の両方でウェブを検索する二重検索の仕組みを持つため、翻訳済みのサイトに対する言語的な偏りはほぼ消える。実際、翻訳済みのスペイン語サイトが獲得した英語の引用は、スペイン語の引用を0.3ポイント上回る程度の差にとどまっていた。なお、未翻訳のサイトでも、ChatGPTの英語引用は、スペインで3.5%、メキシコで4.9%少ない程度で、AI Overviewsほど差は大きくない。
言語と地域が組み合わさると、差はさらに開く
言語だけでなく、検索者がどこにいるかも引用を左右する。米国内のバッファローとロサンゼルスから検証したところ、スペイン語で検索してもスペイン語のソースが引用される割合は約32%にとどまり、大半は英語のソースが占めた。ところが、同じクエリをVPNでメキシコシティに接続して実行すると、スペイン語ソースの比率は約63%まで跳ね上がった。翻訳が「対応言語がある」というシグナルなら、地域はその市場に本気で向き合っているというシグナルであり、両者が揃って初めて強い効果を発揮するということだ。
実例として紹介されているスペイン語圏の書籍販売サイトは、英語の書籍も扱い国際発送にも対応しているが、サイト自体は翻訳されていない。スペイン語での検索で表示される回数を100とすると、同じ内容を英語で検索した場合は36回しか表示されなかったという。
独自考察:「引用の勝敗を分ける要因」より手前にある関門
この連載の前回の記事で、AIが2つの候補から引用元を選ぶとき、トピックの関連性・情報の新しさ・価格情報・リスト内の位置という4つの「ゲートキーパー要因」が勝敗を決めるという実験結果を紹介した。今回の調査が示したのは、その4要因による審査が始まる、さらに手前の関門の存在だ。検索者の言語でページが存在していなければ、関連性がどれだけ高く情報がどれだけ新しくても、比較の土俵に上がれない。言語と地域の一致は、ゲートキーパー要因を評価してもらうための入場チケットのような位置づけにあるといえる。
もう1つ重なるのが、ChatGPTの二重検索という仕組みだ。この連載では以前、GoogleのAI Overviewsが1つの検索語を複数のサブクエリに分解して引用元を集めているクエリファンアウトを紹介したが、ChatGPTの二重検索は、このファンアウトが言語という軸でも起きていることを示している。トピックを分解するだけでなく、検索する言語そのものを分けて2回検索するAIが存在する以上、対応する言語のページを用意していないことは、検索の機会を最初から半分手放していることに等しい。
この調査を読むときの注意点
冒頭で触れた発表元の立場に加えて、もう1つ押さえておきたい制約がある。分析の中心はスペイン語と英語の組み合わせであり、日本語での再現性は検証されていない。調査は2026年8月10日に公開されたが、収集期間やサイトの選び方は、公開ページで詳しく示されていない。日本語は文字体系も検索行動も英語圏とは大きく異なるため、同じ倍率がそのまま当てはまると考えるのは早計だ。数字は「日本語でもこれだけ効く」という根拠としてではなく、「言語がAI検索の可視性を左右する変数である」という構造の裏づけとして受け取るのが妥当だろう。
日本国内のBtoB中小企業の多くは、そもそも日本語話者を相手に商売をしており、日本語のクエリに対しては元から一定の言語の壁に守られている側面がある。それでも、この調査が無関係というわけではない。訪日客向けの商材を扱う企業や、海外の取引先・求職者との接点を持つ企業にとっては、英語のページを用意するかどうかが、AI検索に存在するかどうかを直接左右する段階に入ってきている。翻訳は、使い勝手の改善という位置づけを超え、見てもらえるかどうかを決める前提条件になりつつある。
まとめ:言語の壁は、コンテンツの質より先に効いている
AIがどのページを引用するかを決める要因として、この連載ではこれまで情報の新しさや価格の明記といった中身の要素を紹介してきた。しかし今回の調査が示したのは、その中身を審査してもらう前段階で、言語と地域という土俵そのものが分かれているという事実だ。海外展開や訪日需要に関わりのある企業ほど、対応言語の有無を後回しにしている余裕はなくなってきている。
海外LLMO研究シリーズ・関連記事
- 引用されても効かない?AI検索の「引用吸収」研究から
- AI検索で見えるブランドは36社だけ 1.26億件のプロンプト分析から
- AI Overviewsは1つの検索結果だけを見ていない
- AI検索の可視性は被リンクより言及数
- AIに引用されるページの条件 SIGIR 2026の実験研究から
- LLMO対策に新しい道具は要りません|LLMOとはSEOと何が違うのか
- AIの推薦を信じても、購入前には必ず確認する 3,848人調査から
この記事に書いたことを、そのまま御社のページに
生成AIに引用されるページを、お話しいただくだけでお作りします。お時間をいただくのは初回15分のヒアリングだけです。まず1ページ、無料でお作りします。
OKが出るまで、何度でも直します。事実が違う、言い回しが硬い、この話は入れないでほしい。どれも遠慮なくおっしゃってください。何度お直ししても、追加の料金はいただきません。
これまでに127社にご利用いただきました。毎月ご依頼いただいている方の6割以上が、月10ページを選ばれています。料金はページに掲載しています。
ページを増やしても問い合わせが来ないなら、原因はページの外にあります。その場合は、下の入口からご相談ください。
自社のマーケティング課題を根本から解決しませんか?
ウェブサイトから要素を引き算し、訪れた人が迷わず次の一歩に進む形へ組み直す。初回60分のオンラインで御社のサイトを一緒に読み、どこから直すべきかをお伝えします。手順をまとめた無料の診断と解説動画もご用意しています。
初回は無料・60分・オンライン完結・その場で契約のお願いはいたしません

