arXiv論文メモ
新着一覧
cs.RO · 査読状況未確認

接触を中心に据えたロボット学習用世界モデルWorldContact

WorldContact: A Contact-Centric World Model for Scalable Robot Learning

Caoliwen Wang, Mengdi Wang, Heng Zhang, Shixun Huang, Siyuan Chen, Chao Liu, Anpei Chen, Zhendong Wang, Peter Yichen Chen, Huamin Wang

この論文をやさしく読む

ひとことで言うと

少量の良質な軌跡から接触を中心に物体の動きを学び、柔らかい袋のロボット訓練データを速く増やす世界モデルです。

何に役立つ?

細かい時間刻みが必要な数値シミュレーターの負担を抑え、新しい操作へ方策を適応させる用途です。

この研究の面白いところ

16種類の袋操作を評価し、生成データを加えた同じ方策を実機へ直接移すと、袋持ち上げの1回成功率が65%から95%へ上がりました。

どこまで分かった?

10倍の高速化は単一H100での状態展開で、描画とディスク入出力を除きます。訓練データ生成全体の所要時間が10分の1になったという意味ではありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

ロボットを新しい物体や作業に適応させるには、取得に費用のかかる相互作用経験が必要である。本研究では、変形可能物体の操作を対象とし、限られた高品質軌道から追加の訓練データを効率よく生成する、接触中心の世界モデルWorldContactを提案する。WorldContactは、急速な運動を解像し貫通を防ぐために小さな積分刻みを必要とする元の数値シミュレータよりも大きな時間刻みで物体の力学を予測する。 買い物袋を操作する16課題でWorldContactを評価した。レンダリングとディスク入出力を除く単一のH100 GPU上での状態ロールアウト測定では、元のシミュレータに対して10倍の高速化を得た。生成データを使って既存の視覚・言語・行動ポリシーをファインチューニングし、実ロボットへ直接展開した。袋を持ち上げる課題では、元のシミュレーションデータだけでファインチューニングした同じポリシーの1回試行成功率が65%だったのに対し、WorldContactで拡張したデータセットでは95%になった。これらの結果は、ロボットポリシーの適応にWorldContactで効率的にデータを生成できることを支持する。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-17(UTC)
最新改訂
2026-09-17 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Adapting robots to new objects and tasks requires interaction experience that can be costly to obtain. We present WorldContact, a contact-centric world model for deformable-object manipulation, constructed from a limited set of high-quality trajectories to generate additional training data efficiently. It predicts object dynamics using larger time steps than the source numerical simulator, which requires small integration steps to resolve rapid motion and prevent interpenetration. We evaluate WorldContact across 16 shopping-bag manipulation tasks. State-rollout measurements on a single H100 GPU show a $10\times$ speedup over the source simulator, excluding rendering and disk I/O. We use the generated data to fine-tune an existing vision-language-action policy and deploy it directly on a real robot. In bag lifting, the same policy achieves 65% single-attempt success when fine-tuned on source simulation data alone, compared with 95% when fine-tuned on the dataset expanded with WorldContact. These results support efficient data generation with WorldContact for robot policy adaptation.

arXiv ID: 2609.19600 / 要約の誤りについて