ロボット全身と把持物の衝突を避ける行動フィルター
VLPSA: Vision-Language-Poisson-Safe Actions for Full-Body Safety of Learned Policies
この論文をやさしく読む
ひとことで言うと
学習済みロボットの行動を実行前に調整し、腕の先端だけでなく全身と持っている物の衝突を避ける方法です。元の方策を再学習する構成ではありません。
何に役立つ?
考えられる用途は、障害物や人が動く作業空間での物体操作です。SafeLIBEROの比較とFranka FR3での動作実証があり、衝突回避と作業達成の両立を評価しています。
この研究の面白いところ
把持物をロボットの最終リンクの延長として扱い、安全性計算へ組み込みます。細かく調べる領域と粗く調べる領域を合成して、計算速度との両立を図っています。
どこまで分かった?
91.2%という衝突回避率はSafeLIBEROで評価した条件の結果であり、すべての状況で無衝突だったという意味ではありません。実機実証の衝突率や保証に必要な知覚・制御の仮定は、要旨には詳述されていません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
視覚・言語・行動(VLA)モデルによって、ロボットはより汎用的な物体操作を行えるようになっている。しかし、こうした学習済み方策には、特に訓練分布の外にある環境で、衝突回避の安全性保証がない。本研究は、再学習を行わずに、物が密集し動的に変化する環境でVLA方策に全身の安全性を与える、安全性フィルタリングの枠組みVision-Language-Poisson-Safe Actions(VLPSA)を提示する。 VLPSAは知覚データからPoisson安全関数(PSF)をオンラインで構成し、制御バリア関数(CBF)を得る。これをCBFを用いた二次計画(CBF-QP)安全フィルターによって、ロボット全身と、最後のリンクの延長として扱う任意の把持物に対して適用する。作業上重要な領域で細かな空間解像度を維持しつつリアルタイム運用を可能にするため、VLPSAはブール演算によるCBF合成を用いて、このPSFの二つの解像度を組み合わせる。 SafeLIBEROで安全性フィルタリングのベースラインと比較したところ、評価した手法の中で最高の衝突回避率を達成した。衝突回避率は基礎となるπ0.5方策の23.1%から91.2%へ上昇し、タスク成功率も基礎方策を上回った。さらに、動く障害物や人の介入がある、物の密集した場面でFranka FR3にVLPSAを実装し、操作タスク中にリアルタイムで全身の安全性を確保する動作を示した。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-18(UTC)
- 最新改訂
- 2026-09-18 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-18 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Vision-language-action (VLA) models enable increasingly general-purpose robotic manipulation, but such learned policies do not provide safety guarantees for collision avoidance---especially in environments outside of training distributions. This work presents Vision-Language-Poisson-Safe Actions (VLPSA), a safety filtering framework that provides full-body safety for VLA policies in cluttered and dynamic environments without retraining. VLPSA synthesizes Poisson Safety Functions (PSF) online from perception data, yielding a Control Barrier Function (CBF) that is enforced through a CBF-QP safety filter over the full body and any grasped object, treated as an extension of the final robot link. To enable real-time deployment while maintaining fine spatial resolution in critical task regions, VLPSA combines dual resolutions of this PSF using Boolean CBF compositions. We evaluate VLPSA on SafeLIBERO against safety-filtering baselines, where it achieves the highest collision avoidance rate among the evaluated methods, increasing collision avoidance from 23.1% for the base $\pi_{0.5}$ policy to 91.2% while surpassing its task success rate. We further deploy VLPSA on a Franka FR3 in cluttered scenes with dynamic obstacles and human interference, demonstrating real-time full-body safety during manipulation tasks.
arXiv ID: 2609.22462 / 要約の誤りについて