失敗記憶と対立検出で監査可能なロボット判断
CoreSense: Traceable Failure Recall and Conflict-Aware Belief Gating for Auditable Robot Decisions
この論文をやさしく読む
ひとことで言うと
ロボットが過去の失敗を思い出したとき、その記憶が今の状況でも有効かを確かめてから判断する仕組みです。出所、時間、矛盾、根拠の十分さを検査し、再観測や保留も選びます。
何に役立つ?
過去の証拠に基づくロボットの推奨を、後から監査できる形にする設計の参考になります。記憶を取り出せたことと、そのまま行動してよいことを分けて扱います。
この研究の面白いところ
誤った続行を減らすだけでは、すべて止める方策も高評価になってしまいます。本研究は不必要な停止やカバレッジも併記し、0%の危険続行だけでは十分でないことを示しています。
どこまで分かった?
実ロボットへ指令を出さない評価で、公開実機データ、固定した信号シミュレーション、クラウド経路を使っています。把持喪失への転用は否定的結果です。自律復旧や認証済み安全性の実証ではないと著者が明記しています。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
ロボットは過去の失敗を想起できても、想起した証拠が現在も有効か、現在の観測と矛盾しないか、判断を導くのに十分かを知っているとは限らない。本研究では、追跡可能なエピソード証拠、対立を考慮する信念ゲート、上限付きで監査可能な提案を組み合わせたロボットシステム統合アーキテクチャ、CoreSenseを提示する。 ゲートは、範囲、出所、時刻、矛盾、裏付けを確認してから、PROCEED、再観測要求、棄権、エスカレーションのいずれかを許可する。評価は物理ロボットを指令せず、公開された実ロボットデータ、凍結した信号レベルのシミュレーション、クラウドでの実行経路という三つの相補的な層で行う。 CableTrace-120とBotFails-200では、信念ゲートにより、プロトコルで定義したunsafe proceedがそれぞれ20%と40%から0%に低下した。互いに重ならないデータで較正した生動画ポリシーもunsafe proceedを0%にしたが、正常なエピソードをすべて過剰にブロックした。公開データでは、ViFailback-BotFailsの視覚検出器はAUROC 0.778に達したものの、やはりすべてをブロックした。一方、サイクルを分けたUR3テレメトリによる保護停止では、unsafe proceed 0%、過剰ブロック36.1%、カバレッジ61.9%となった。グリップ喪失の転移は否定的な結果だった。 制御された物理的な裏付け実験では、値はそれぞれ3.3%、0%、42.0%となり、対立を考慮した融合では4.7%、0%、42.8%となった。最後に、CockroachDB Cloud–Amazon Bedrockの展開経路で20回中20回のクラウド想起を検証した。証拠が支持するのは監査可能な統合パターンであり、自律的な復旧や認証済みの安全性ではない。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-17(UTC)
- 最新改訂
- 2026-09-17 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-17 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Robots can recall prior failures without knowing whether recalled evidence remains valid, conflicts with current observations, or is sufficient to guide a decision. We present CoreSense, a robot-system integration architecture that combines traceable episodic evidence with a conflict-aware belief gate and bounded, auditable recommendations. The gate checks scope, provenance, time, contradiction, and support before it permits PROCEED, requests re-observation, abstains, or escalates. Evaluation follows three complementary layers without commanding a physical robot: offline public real-robot data, a frozen signal-level simulation, and a live cloud deployment path. On CableTrace-120 and BotFails-200, belief gating reduces protocol-defined unsafe proceeds from 20% and 40% to 0%. A disjointly calibrated raw-video policy also reaches 0% unsafe proceed, but overblocks every nominal episode. On public data, a ViFailback-BotFails visual detector reaches 0.778 AUROC yet remains all-blocking, whereas cycle-disjoint UR3 telemetry for protective stops yields 0% unsafe proceed, 36.1% overblocking, and 61.9% coverage; grip-loss transfer remains a negative result. Controlled physical corroboration yields 3.3%, 0%, and 42.0%, while conflict-aware fusion yields 4.7%, 0%, and 42.8%. Finally, 20/20 cloud recalls validate a CockroachDB Cloud-Amazon Bedrock deployment path. The evidence supports an auditable integration pattern, not autonomous recovery or certified safety.
著者のコメント
6 pages, 2 figures, 3 tables.Preprint
arXiv ID: 2609.19512 / 要約の誤りについて