実行中の失敗から学びロボット作業を途中で修正
CARE: Experience-Guided Atomic Corrective Execution for Vision-Language-Action Policies
この論文をやさしく読む
ひとことで言うと
ロボットが途中で失敗した状態を集め、その状態から作業を立て直す動きを学習する手法です。
何に役立つ?
一度のずれで最初からやり直すのではなく、既にできた部分を保ちながら調整や再操作を行う用途に役立ちます。シミュレーションと実機の双腕作業で評価しています。
この研究の面白いところ
失敗状態を人が想定して作るだけでなく、実際の実行で起きたずれの分布から修正用データを作ります。実行監視と段階別計画も組み合わせています。
どこまで分かった?
平均改善はシミュレーション14.5ポイント、実世界15.9ポイントで、相対的な14.5%や15.9%とは区別が必要です。要旨に各タスクの絶対成功率や、すべての失敗から回復できる保証はありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
視覚・言語・行動(VLA)方策はロボット操作で高い性能を達成するが、実行が標準的な軌跡から外れると依然として脆い。本研究では、実行中に遭遇した失敗から学ぶことで復旧能力を改善する枠組み CARE(Corrective Atomic Robotic Execution)を提案する。手動で設計した摂動やランダムな摂動から修正データを生成する代わりに、CARE は失敗した実行軌跡を集め、段階を条件とする失敗後のずれをモデル化し、その経験的分布から代表的な失敗状態と修正動作の実演を合成する。 推論時には、段階ごとの計画と物理的な状況に根差した3次元監視を組み合わせ、タスクの進捗を保ちながら、最小単位の調整や操作のやり直しを起動する。さらに、局所的なずれと構造的な異常の下で、中間的な失敗状態からの復旧を評価する Failure State Recovery Benchmark(FSR-Bench)を導入する。複数の VLA バックボーン、シミュレーションのベンチマーク、実世界の双腕タスクにわたる実験で一貫した改善がみられ、タスク成功率は平均で、シミュレーションでは14.5ポイント、実世界では15.9ポイント向上した。コード、モデル、データは https://github.com/xiaojunlan/care で公開されている。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-21(UTC)
- 最新改訂
- 2026-09-21 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-21 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Vision-Language-Action (VLA) policies achieve strong performance in robotic manipulation but remain brittle once execution deviates from nominal trajectories. We propose CARE (Corrective Atomic Robotic Execution), a framework that improves recovery by learning from failures encountered during execution. Instead of generating corrective data from manually designed or random perturbations, CARE collects failed rollouts, models stage-conditioned post-failure deviations, and uses the resulting empirical distributions to synthesize representative failure states and corrective demonstrations. At inference time, CARE combines stage-wise planning with physically grounded 3D monitoring to trigger atomic adjustments or re-operations while preserving task progress. We further introduce the Failure State Recovery Benchmark (FSR-Bench), which evaluates recovery from intermediate failure states under local deviations and structural anomalies. Experiments across multiple VLA backbones, simulation benchmarks, and real-world dual-arm tasks show consistent improvements, with average task-success gains of 14.5 points in simulation and 15.9 points in the real world. Code, models, and data are available at https://github.com/xiaojunlan/care
著者のコメント
22 pages, 16 figures
arXiv ID: 2609.24118 / 要約の誤りについて