arXiv論文メモ
新着一覧
cs.RO · 査読状況未確認

簡略模型から学び人型ロボットを複数階で安全に誘導

Learning Safe Humanoid Navigation from Reduced Order Models

William D. Compton, Zachary Olkin, Ryan Bena, Aaron D. Ames

この論文をやさしく読む

ひとことで言うと

人型ロボットの移動経路を、まず簡略化した体の模型で学ばせ、その知識を実際の体の動きへ移す研究です。実機で地図なしの複数階移動を示しています。

何に役立つ?

考えられる用途は、階段や高低差を含む建物内の自律移動です。経路選択と複雑な歩行動作の学習を分けることで、複数階へ対応する負担を減らそうとしています。

この研究の面白いところ

動力学は簡略化しても、3次元LiDARによる周囲の観測は保ちます。さらに学習外の障害物に対して安全フィルタを使い、成功率を落とさず安全性を回復する結果を示しています。

どこまで分かった?

要旨での実機はUnitree G1です。高さ10 m超・経路100 m超の試行は報告されていますが、全試行数や成功率の具体値は記載されていません。あらゆる障害物や建物での安全保証を示したものではありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

人型ロボットの研究では移動能力が急速に進歩し、最近の成果は自律ナビゲーションの限界も押し広げている。しかし、通常の単段階の強化学習によるナビゲーション手順は、階段など、人型ロボットと地形の複雑な相互作用が難しいため、高低差や複数階のある地形へ拡張しにくいことを示す。この課題を克服するため、ナビゲーション問題を2つに分ける。 まず、動力学を低次元化した模型で動作しながら、完全な3次元LiDAR観測を受け取る方策を学習させ、複雑な複数階の地形を移動できるようにする。次に、このナビゲーションの知識を利用し、固定した歩行方策をループ内に組み込んだ、完全な人型ロボット動力学上の方策の学習を立ち上げる。さらに、ナビゲーション方策の出力にポアソン安全フィルタを適用すると、分布外の障害物がある状況でも、ナビゲーション成功率を下げずに安全性を回復できることを示す。 得られたRoM-Nav方策をUnitree G1上で実証し、地図を使わない複数階ナビゲーションを達成した。試行には、高さ方向の移動が10 mを超え、経路長が100 mを超えるものが含まれる。動画を掲載したプロジェクトページは https://wdc3iii.github.io/rom-nav/ である。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-16(UTC)
最新改訂
2026-09-16 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Research in humanoid robotics has achieved rapid progress in locomotion, and recent results have pushed the boundary on autonomous navigation. We demonstrate that a standard single-stage RL navigation pipeline struggles to scale to multi-level and multi-story terrain, limited by the difficulty of complex humanoid terrain interactions such as stairs. To overcome this challenge, we decompose the navigation problem into two pieces. First, we train a policy operating on the reduced order dynamics but with full 3D LiDAR observations to navigate complex, multi-story terrain. We then utilize this navigation knowledge to kickstart a policy operating on the full-order humanoid dynamics, with a frozen locomotion policy in the loop. Additionally, we demonstrate that applying a Poisson safety filter to the navigation policy output recovers safety in the presence of out-of-distribution obstacles, without dropping navigation success rate. We demonstrate the resulting RoM-Nav policy on a Unitree G1, accomplishing mapless multi-floor navigation covering trials with over 10m of vertical displacement and over 100m of path length. Project page with videos https://wdc3iii.github.io/rom-nav/ .

著者のコメント

8 pages, 6 figures, under review for ICRA 2027

arXiv ID: 2609.19272 / 要約の誤りについて