arXiv論文メモ
新着一覧
cs.IR · 査読状況未確認

百度とGoogleのAI検索で表示される情報源の違いを調査

Auditing Source Exposure in Baidu and Google AI Search

Yibo Li, Enci Guan, Yuedan Cai, Geng Liu, Francesco Pierri

この論文をやさしく読む

ひとことで言うと

百度とGoogleで同じ意図の英語・中国語検索を行い、AIの回答と表示される情報源を比較した研究です。回答が似ていても、目に入る情報源は異なることを調べています。

何に役立つ?

AI検索を評価するとき、回答内容に加えて情報源の露出も測る必要があることを示します。検索サービスや言語による情報の見え方の違いを調べる参考になります。

この研究の面白いところ

対応する回答の意味的類似度と、全体で表示されるドメイン集合の重なりを別々に測っています。同じような答えを返すことと、同じ情報源を可視化することは別の指標だと示しています。

どこまで分かった?

対象はMS MARCOの英語クエリとその中国語訳です。要旨には調査時期やクエリ数がなく、表示されたドメインの調査から内部で実際に参照した全情報源までは分かりません。類似度は回答の正確さそのものを示しません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

AIが生成する概要は検索インターフェースの中でますます目立つ層になっているが、中国語検索での振る舞いは十分に研究されていない。本研究では、MS MARCOから抽出した英語の検索クエリと、それを中国語に翻訳した対応クエリを用いて、百度とGoogleのAI概要の振る舞いを言語横断的に監査する。 分析では、プラットフォームと言語の各組み合わせで概要がどのような場合に表示されるか、中国語の概要でどのホストドメインが可視的に露出するか、その露出がどれだけ集中するか、設定間で情報源の重なりがどう変わるかを調べる。また、同じ意図のクエリについて、生成された回答の埋め込み表現に基づく意味的類似度を比較する。 結果から、概要の利用可能性と可視的な情報源の露出には、プラットフォームと言語の組み合わせによって大きな違いがあることが分かる。集計レベルでは、可視的なホストドメインの集合の重なりは小さい。一方、対応するクエリの回答間では、コサイン類似度の中央値は0.701~0.813の範囲にある。これらの知見は、回答レベルの意味的類似性と、集計した情報源の露出が、AIを介した検索の異なる側面を捉えることを示している。したがってAI検索の評価では、生成された回答の内容だけでなく、情報源の可視性がプラットフォーム、言語、情報環境の間でどのように配分されているかも考慮すべきである。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-21(UTC)
最新改訂
2026-09-21 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

AI-generated overviews are becoming an increasingly prominent layer of search interfaces, yet their behavior in Chinese-language search remains underexplored. We conduct a cross-lingual audit of AI overview behavior on Baidu and Google using English queries sampled from MS MARCO and their translated Chinese counterparts. Our analysis examines when overviews are triggered across platform-language settings, which host domains receive visible exposure in Chinese-language overviews, how concentrated that exposure is, and how source overlap varies across settings. We also compare the embedding-based semantic similarity of generated answers for matched query intents. The results reveal substantial differences across platform-language settings in overview availability and visible source exposure. At the aggregate level, the settings exhibit low overlap in visible host-domain inventories, while matched-query answers yield median cosine similarities ranging from 0.701 to 0.813. These findings indicate that answer-level semantic similarity and aggregate source exposure capture distinct dimensions of AI-mediated search. Evaluations of AI search should therefore consider not only the content of generated answers but also how source visibility is distributed across platforms, languages, and information environments.

著者のコメント

Accepted at WAC @ EMNLP 2026

arXiv ID: 2609.24407 / 要約の誤りについて