arXiv論文メモ
新着一覧
cs.MM / cs.AI / cs.MA · 査読状況未確認

異議申し立ての記録を生かすマルチメディア検証

Self-Evolving Multimedia Verification through Memory Consolidation of Contestation Experiences

Truong Thanh Hung Nguyen, Vo Thanh Khang Nguyen, Hoang-Loc Cao, Phuc Ho, Truong Thinh Nguyen, Van Pham, Hung Cao

この論文をやさしく読む

ひとことで言うと

画像や動画などの検証で、人からの異議と訂正を記録に取り込み、後の判断に安全に使う枠組みを評価した。

何に役立つ?

検証システムで、判断根拠の追跡、人の訂正、過去の記憶の再利用を両立させる設計の参考になる。

この研究の面白いところ

COSMOSで正解率91.88%を報告し、検証済み記憶によって負の転移を5.7%から0.2%に下げた。

どこまで分かった?

報告された性能はCOSMOS、CTR、MV2026の評価条件に基づき、すべてのマルチメディア検証場面で同じ結果になることは示していない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

マルチメディアの検証には、正確な判断だけでなく、証拠を追跡できること、人による確実な訂正、過去の経験を安全に再利用できることが必要である。既存のシステムには、中間の推論を修正したり、有害な知識の転用を防いだりする明示的な仕組みが欠けることが多い。本研究は、出所情報を伴う議論を証拠、推論、人による異議申し立て、記憶の間の接点として扱う、自己更新型の複数エージェントの枠組みSEMVを提示する。SEMVは、アリーナに基づく定量的な双極議論枠組み、因果関係と適用範囲に基づく修正、検証を通った記憶の統合を組み合わせ、対立する情報も明示的に保持する。COSMOSベンチマークでは、最も強い比較可能な基準法の正解率89.10%に対し、SEMVは91.88%を得た。検証済みの記憶は負の転移を5.7%から0.2%に減らした。査読者の異議から構築したCTRベンチマークでは、範囲を限定した因果的修正により初期の誤りの96.7%を訂正し、計算量を52.8%削減した。MV2026 Grand Challengeデータセットでの評価も、証拠に根ざし、時間的に整合した報告を支持した。これらの結果は、蓄積した知識とその後の判断を追跡、修正、異議申し立て可能な状態に保ちながら、検証済みの経験を通じてSEMVを更新できることを示す。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-23(UTC)
最新改訂
2026-09-23 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Multimedia verification requires not only accurate decisions but also traceable evidence, reliable human correction, and safe reuse of prior experience. Existing systems often lack explicit mechanisms for revising intermediate reasoning or preventing harmful knowledge transfer. We present SEMV (Self-Evolving Multimedia Verification), a self-evolving multi-agent framework that treats provenance-bearing arguments as the interface between evidence, reasoning, human contestation, and memory. SEMV combines arena-based quantitative bipolar argumentation (A-QBAF), causal and scoped revision, and verification-gated memory consolidation with explicit conflict retention. On COSMOS benchmark, SEMV achieves 91.88% accuracy versus 89.10% for the strongest comparable baseline. Verified memory reduces negative transfer from 5.7% to 0.2%. On CTR benchmark, constructed from reviewer contestations, scoped causal revision corrects 96.7% of initial errors while saving 52.8% compute. MV2026 Grand Challenge dataset further supports evidence-grounded, temporally consistent reporting. These results show that SEMV can evolve through verified experience while keeping accumulated knowledge and subsequent decisions traceable, revisable, and contestable.

arXiv ID: 2609.27175 / 要約の誤りについて