歩行ロボットの応答をそろえて移動中のアーム操作を改善
ReCo: Response-Consistent Locomotion with Policy-Aware MPC for Legged Manipulation
この論文をやさしく読む
ひとことで言うと
歩行指令に対する胴体の動きを予測しやすく学習させ、その予測を使って、歩きながらアームの先端位置を合わせる方法です。
何に役立つ?
脚式ロボットが移動を止めずに手先で作業する場面で、歩行による手先のずれを補償するために役立ちます。
この研究の面白いところ
制御器だけを高度化するのではなく、歩行方策の応答自体を一貫させてから、閉ループモデルを使って胴体とアームを同時に計画しています。
どこまで分かった?
28.7%と27.4%の誤差低減はシミュレーションでの値です。実機では連続操作を実証していますが、要旨には同じ改善率を実機で測ったとは記載されていません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
脚で歩くロボットが連続的に物体を操作するには、胴体が歩行を続けながら、手先を正確に目標へ追従させる必要がある。強化学習(RL)とモデル予測制御(MPC)の組合せは、この課題に適している。学習済み方策が頑健な歩行を提供し、MPCが胴体とアームを協調させて追従誤差を補償するためである。しかし、MPCが補償できるのは予測可能な胴体運動に限られ、学習済み方策の指令への応答は、歩行位相、接触、積載物によって変化する。 本研究では、応答が一貫する歩行と、方策を考慮するMPCを組み合わせる脚移動型マニピュレーションの枠組みReCoを提示する。応答整形によって、動力学をランダム化した条件でも指令に一貫して再現可能に応答するよう方策を学習する。続いて、同定した閉ループ応答モデルを用い、MPCが歩行指令とアーム運動を共同で計画する。 シミュレーションのベンチマークで、ReCoは、各指標で最も良いベースラインと比べて、位置の二乗平均平方根誤差(RMSE)を28.7%、姿勢のRMSEを27.4%削減した。実環境の実験では、機体上で計算を行い、胴体とアームの運動を協調させた連続的な脚移動型マニピュレーションを実証した。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-10-01(UTC)
- 最新改訂
- 2026-10-01 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-10-01 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Continuous legged manipulation requires accurate end-effector tracking while the base keeps walking. Combining reinforcement learning (RL) with model predictive control (MPC) suits this task: the learned policy provides robust locomotion, while MPC coordinates the base and arm to compensate for tracking errors. However, MPC can compensate only for base motion that it can predict, and a learned policy's command response varies with gait phase, contact, and payload. We present ReCo, a framework that couples response-consistent locomotion with policy-aware MPC for legged manipulation. Response shaping trains the policy to respond to commands consistently and repeatably across randomized dynamics. An identified closed-loop response model then lets MPC jointly plan locomotion commands and arm motion. On the simulation benchmark, ReCo reduces position and orientation root-mean-square error (RMSE) by 28.7% and 27.4% relative to the best baseline for each metric. Real-world experiments demonstrate onboard continuous legged manipulation with coordinated base and arm motion.
arXiv ID: 2610.01612 / 要約の誤りについて