arXiv論文メモ
新着一覧
cs.RO · 査読状況未確認

物体を持ち替えて見えない面を調べるFlipToSee

FlipToSee: A Probabilistic Stable Placement Prior for Active Visual Exploration via Regrasping

Chang Shu, Sushil Samuel Dinesh, Shinkyu Park

この論文をやさしく読む

ひとことで言うと

物体の見えていない面を調べるため、つかみ直した後に安定して置ける向きを一枚の点群から予測します。

何に役立つ?

ロボットが卓上物体をひっくり返して観察するとき、すべての姿勢を実際に試す手間を減らすための方法です。

この研究の面白いところ

置き方を六自由度全体ではなく支持面の法線で表し、複数の安定姿勢を確率分布として学びます。候補の多様さと物理的な頑健性を別に評価します。

どこまで分かった?

98.4%、95.3%、90.0%は異なる物体群でのシミュレーションの第一候補成功率です。実ロボットでのつかみ直しも示しますが、その数値を実機成功率と取り違えないことが重要です。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

卓上物体を能動的に視覚探索するには、静置された未知の物体を別の安定した支持面へ向け直し、遮蔽された表面を見えるようにする必要があることが多い。物理的な総当たり探索をせずにその置き方を特定するため、単一視点の点群から、置き方に関する確率的な事前分布を学習する。安定した置き方の予測は本質的に複数のモードを持ち、従来の6自由度回帰では、並進と面内ヨー回転もモデル化するため、さらに曖昧さが生じる。 そこで、置き方を球面S²上の単位支持法線としてパラメータ化して表現上の曖昧さを取り除き、von Mises–Fisher混合密度ネットワークによって多峰性の条件付き分布をモデル化する確率的枠組み、FlipToSeeを提案する。モードの多様性と物理的頑健性を切り分けるため、FlipToSeeは混合成分から小さな候補集合を決定論的に抽出する。その後、候補に対応した教師信号で訓練した補助ヘッドを使い、頑健性を考慮して順位を付け直す。 シミュレーションでは、最初の提案の成功率は、分布内の物体で98.4%、分布外の形状で95.3%、家庭用品からなるYCB物体へのゼロショット転移で90.0%となった。さらに、学習した置き方の事前分布を把持計画・動作計画と統合し、探索のための持ち替えを実機ロボットで実証する。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-17(UTC)
最新改訂
2026-09-17 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Active visual exploration of tabletop objects often requires reorienting an unknown resting object onto a different stable support face to expose occluded surfaces. To identify such placements without exhaustive physical search, we learn a probabilistic placement prior from a single-view point cloud. Stable placement prediction is inherently multimodal, and conventional 6-DoF regression introduces further ambiguity by modeling translation and in-plane yaw. We therefore propose FlipToSee, a probabilistic framework that removes this representational ambiguity by parameterizing placements as unit support normals on $S^2$ while modeling their multimodal conditional distribution via a von Mises--Fisher mixture density network. To decouple mode diversity from physical robustness, FlipToSee deterministically extracts a compact candidate set from the mixture components and applies robustness-aware reranking using an auxiliary head trained with candidate-aligned supervision. In simulation, FlipToSee achieves $98.4\%$ first-proposal success on in-distribution objects, $95.3\%$ on out-of-distribution shapes, and $90.0\%$ under zero-shot transfer to household YCB objects. We further demonstrate the learned placement prior on a physical robot by integrating it with grasp and motion planning for exploratory regrasping.

arXiv ID: 2609.20078 / 要約の誤りについて