回答前に引用根拠を照合する企業向け検索支援手法
EvidenT: Building Trustworthy Enterprise Assistants through Evidence Groundedness and Traceability
この論文をやさしく読む
ひとことで言うと
検索で得た文書と引用候補の文章を回答生成前に照合し、根拠のない引用や引用先のずれを減らす仕組みです。
何に役立つ?
社内文書に基づく回答で、どの箇所を根拠にしたか確認しやすくする用途が考えられます。モデルの再学習を必要としない点も導入方法を検討する材料です。
この研究の面白いところ
生成モデルへの指示だけで引用を整えるのではなく、文章の抽出と決定論的な語彙照合を処理として組み込んでいます。
どこまで分かった?
評価は約500件の企業内クエリです。29%の改善が相対値かポイント差かは要旨では明示されていません。語彙的な一致や未検索URLへの引用がないことだけで、回答内容の意味上の正確さ全般が保証されるわけではありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
企業向けAIアシスタントには、検証可能で、情報源の根拠まで追跡できる回答が求められる。しかし、異種の企業データを対象にした検索拡張生成(RAG)では、引用先のずれ、裏付けのない内容、情報源の追跡性の弱さが生じうる。 モデルの再学習を行わず、回答生成前に抽出した根拠を検索済み文書と照合する軽量な処理系EvidenTを提案する。TはTrust、Transparency、Traceability、すなわち信頼・透明性・追跡性を表す。EvidenTは、構造化された文章箇所の抽出と決定論的な語彙照合を組み合わせ、裏付けのない内容を取り除き、引用先のずれを訂正し、情報源の該当範囲への追跡性を保つ。約500件の実際の企業内クエリでは、プロンプトによるベースラインに比べて正解情報源のヒット率が平均29%向上し、検索されていないURLへの引用を一切生成せず、回答から情報源への語彙的なカバー率はほぼ上限に達した。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-18(UTC)
- 最新改訂
- 2026-09-18 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-18 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Enterprise AI assistants must produce responses that are verifiable and traceable to source evidence. However, retrieval augmented generation (RAG) over heterogeneous enterprise data can suffer from citation drift, unsupported content, and weak source traceability. We present EvidenT (T = Trust + Transparency + Traceability), a lightweight pipeline that verifies extracted evidence against retrieved documents before answer generation, without model retraining. EvidenT combines structured passage extraction with deterministic lexical alignment to filter unsupported content, correct citation drift, and preserve source-span traceability. On approximately 500 real enterprise queries, EvidenT improves gold-source hit rate by an average of 29% over prompting baselines, produces no citations to nonretrieved urls, and achieves near-saturated answer-to-source lexical coverage.
著者のコメント
Accepted in EMNLP Industry Track 2026
arXiv ID: 2609.22537 / 要約の誤りについて