arXiv論文メモ
新着一覧
cs.CL / cs.AI · 査読状況未確認

複数人の長い会話で根拠と現在の記憶状態を分けて管理

Propose, Verify, Commit: Evidence-Grounded Memory for Long-Horizon Multi-Actor Conversations

Zihao Lu, Zhihang Yuan, Lei Shi

この論文をやさしく読む

ひとことで言うと

過去の発言そのものと、後の訂正を反映した現在の情報を分けて記憶し、質問時に根拠をたどる方法です。

何に役立つ?

複数人が話し、情報が後で変わる長い会話で、古い発言をそのまま最新情報として扱うことを避ける用途が考えられます。

この研究の面白いところ

書き込み時の提案・検証・確定と、読み出し時の反復的な根拠探索を組み合わせ、メッセージの証拠を残します。

どこまで分かった?

専用方策の学習は不要ですが、プロンプトとツールを用いるシステムです。ベンチマークの改善幅はパーセントポイントで、コードは要旨時点では公開予定とされています。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

長期的な会話記憶は、複数の参加者がいる場合に特に難しい。関連する証拠が参加者や文脈に分散し、以前に確立した情報が後で修正されることもあるためである。本研究ではEGMEMORYを導入する。長期の複数参加者の記憶を、持続的なメッセージ単位の証拠と、明示的な現在の状態を分離する、検索可能な状態機械として定式化する。 書き込み時には、適応的な状態の解決と、証拠に基づく「提案・検証・確定」の手順が、状態の更新を制御する。読み出し時には、適応的な証拠探索が、質問に必要な状態とそれを裏付ける証拠を繰り返し特定する。その際、会話構造を用いて検索範囲を絞り、語彙的・意味的な関連性で候補を順位付けする。このシステムは、記憶専用の方策を学習せず、プロンプトとツール使用によって動作する。 EGMEMORYはGroupMemBenchで68.2%、EverMemBenchで77.9%を達成し、評価した中で最も強い基準手法をそれぞれ22.7、21.4パーセントポイント上回る。さらに2者間会話のLoCoMoベンチマークでも73.6%に達し、複数参加者の会話を越えた汎化を示す。正式な発表に合わせてコードを公開する予定である。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-20(UTC)
最新改訂
2026-09-20 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Long-horizon conversational memory is especially challenging in multi-actor settings, where relevant evidence is distributed across participants and contexts and previously established information may later be revised. We introduce EGMEMORY, which formulates long-horizon multi-actor memory as a searchable state machine that separates persistent message-level evidence from an explicit active state. At write time, adaptive state resolution and an evidence-grounded propose-verify-commit protocol govern how this state evolves. At read time, adaptive evidence navigation iteratively resolves the state and supporting evidence required for a query, using conversational structure to narrow the search space and lexical-semantic relevance to rank candidates. The system operates through prompting and tool use without memory-specific policy training. EGMEMORY achieves 68.2% on GroupMemBench and 77.9% on EverMemBench, outperforming the strongest evaluated baselines by 22.7 and 21.4 percentage points, respectively. It further reaches 73.6% on the dyadic LoCoMo benchmark, demonstrating generalization beyond multi-actor conversations. We will release the codebase upon formal publication.

arXiv ID: 2609.23465 / 要約の誤りについて