arXiv論文メモ
新着一覧
cs.CV · 査読状況未確認

グラフを読むAIの根拠と計算過程を検証しやすくする

Monitorable Chart Reasoning Agents via Verifiable Process Rewards

Sanchit Sinha, Oana Frunza, Kashif Rasul, Aidong Zhang

この論文をやさしく読む

ひとことで言うと

グラフへの質問に答えるAIに、グラフの種類、読み取った表、計算手順を分けて出させ、どこで間違えたか調べやすくします。

何に役立つ?

グラフから数値を読み取るシステムの監査や、読み取りと計算の誤りの切り分けに役立ちます。

この研究の面白いところ

最終正答だけでなく、途中の過程にも検証可能な報酬を与えます。監視しやすさの評価も単一の採点にせず、正解に基づく指標とLLM監査などを組み合わせています。

どこまで分かった?

比較は同程度の規模のLVLMと六つのベンチマークについてです。要旨には各スコアの具体値はなく、検証しやすい説明が内部計算を完全に再現するとの保証も記載されていません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

グラフ推論エージェントは、重要な分野で行動につながる知見を取り出すために使われることが増え、複数のベンチマークで最先端の性能を達成している。しかし、実際の導入では、関係者がモデルの回答に至る過程を監査・検証できる必要があり、高いベンチマーク正解率だけでは十分でない。既存の大規模視覚言語モデル(LVLM)に基づくグラフエージェントは、答えだけを予測するか、検証しにくい自由形式の理由を生成する。そのため、誤りがグラフの読み違い、誤った値の抽出、計算間違いのどこで生じたのかが見えにくい。 本研究では、検証可能な過程報酬を使い、監視可能なグラフエージェントを学習する強化学習の枠組みChart-RVRを提案する。Chart-RVRはグラフ推論を、監査可能な三つのブロックに分解する。Structureはグラフの種類を特定し、Evidenceは元となるデータ表をJSONで再構成し、Derivationは答えを計算する段階的な手順を明示する。 領域内・領域外の六つのベンチマークで、Chart-RVRは同程度の規模のLVLMの中で最先端の正解率を達成する。正解率に加え、正解データに基づく代理指標、オラクルを用いた情報利得尺度、過程の検証可能性と証拠位置の特定を採点するLLM監査者を組み合わせた、多面的な評価手順で監視可能性を調べる。その結果、Chart-RVRは、思考連鎖(CoT)プロンプト、教師付き微調整(SFT)、既存のグラフ専用ベースラインより、明確に検証しやすく、証拠に基づいた理由付けを生成することが示される。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-21(UTC)
最新改訂
2026-09-21 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Chart reasoning agents are increasingly used to extract actionable insights in critical domains, achieving state-of-the-art performance on multiple benchmarks. Yet, high benchmark accuracy alone is insufficient for deployment, where stakeholders must be able to audit and verify how a model reaches its answer. Existing LVLM-based chart agents produce either answer-only predictions or free-form rationales that are hard to verify, obscuring whether an error arose from misreading the chart, extracting a wrong value, or miscomputing. We propose Chart-RVR, a reinforcement learning framework for training monitorable chart agents with verifiable process rewards. Chart-RVR decomposes chart reasoning into three auditable blocks: Structure, identifying the chart type; Evidence, reconstructing the underlying data table in JSON; and Derivation, exposing the stepwise trace that computes the answer. Across six in-domain and out-of-domain benchmarks, Chart-RVR attains state-of-the-art accuracy among comparable-sized LVLMs. Beyond accuracy, we assess monitorability using a triangulated protocol that combines ground-truth surrogate metrics, an oracle information-gain measure, and an LLM-as-auditor scoring Process Verifiability and Evidence Localization, showing that Chart-RVR yields rationales that are markedly more verifiable and evidence-grounded than those from CoT prompting, SFT, and existing chart-specific baselines.

著者のコメント

EMNLP 2026 Findings

arXiv ID: 2609.24071 / 要約の誤りについて