一度の軌道変形でロボットの把持動作を作る
2nd Place Solution to the HANDS 2026 Workshop Challenge-Dexterous Grasp Motion Track: Single-Shot Trajectory Warping for Grasp Motion Generation
この論文をやさしく読む
ひとことで言うと
ロボットの手の動きを毎時刻決める代わりに、うまくいった一つの動作例を最初に変形して再生する方法です。
何に役立つ?
考えられる用途は、既存の把持実演を新しい物体や初期姿勢に合わせて使い回すことです。この報告では、シミュレーションの把持動作コンペで成績を評価しています。
この研究の面白いところ
約70回の逐次判断を、実演への一回の12次元変形に置き換えます。多数の物体で変形方法を学ぶことで、単一の成功例を出発点にしています。
どこまで分かった?
報告された成功率はシミュレーションの非公開テストであり、実機結果ではありません。easyでは94.61%に対しhardでは57.18%です。軌道は開ループで再生する構成で、要旨には途中の観測で修正する仕組みは記載されていません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
本報告では、ECCV 2026と併催されるHANDS 2026ワークショップのチャレンジ(Dexterous Grasp Motion部門)で2位となった手法を説明する。このチャレンジでは、12自由度のLinkerHand O6の把持動作生成に取り組み、シミュレーション内でランダム化された手の初期姿勢から、未見の物体に向かって手を伸ばして持ち上げる、物理的にもっともらしい軌道の生成を目指す。 この課題が特に難しいのは、一回の把持で逐次方策が約70回の12次元の判断を行う必要があり、時間とともに誤差が蓄積するうえ、テスト物体や物理ダイナミクスが学習時と異なり得るためである。これらに対処するため、動作を一歩ずつ生成する代わりに、一つの成功したGraspM3の実演を編集することを提案する。方策は物体を一度観測し、実演の12次元の変形を出力し、その後は変形した軌道を開ループで再生する。さらに、全4,824個の学習物体を並列に用いた1ステップPPOで変形方策を学習する。 その結果、非公開テストセットのeasyトラックで全提出中最高の94.61%、hardトラックで57.18%の成功率を達成した。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-18(UTC)
- 最新改訂
- 2026-09-18 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-18 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
This report describes our 2nd place solution to the HANDS 2026 workshop challenge (Dexterous Grasp Motion track) in conjunction with ECCV 2026. In this challenge, we address grasp motion generation for the 12-DoF LinkerHand O6, aiming to produce physically plausible reach-and-lift trajectories for unseen objects from randomized initial hand poses in simulation. This task is particularly challenging because each grasp requires a per-step policy to make approximately $70$ twelve-dimensional decisions, with errors accumulating over time, while test objects and physical dynamics may differ from those encountered during training. To address these challenges, we propose editing a single successful GraspM3 demonstration instead of generating the motion step by step: a policy observes the object once and outputs a 12-D warp of the demonstration, which is then replayed open-loop. Moreover, we train the warp policy with one-step PPO over all $4{,}824$ training objects in parallel. As a result, our method achieved success rates of $94.61\%$ on the easy track, the highest of all submissions, and $57.18\%$ on the hard track of the private test set.
arXiv ID: 2609.21511 / 要約の誤りについて