arXiv論文メモ
新着一覧
cs.RO · 査読状況未確認

触覚センサーなしで接触状態を推定するロボット把持

ZeroTouch: Tactile-Supervised Visual Contact Estimation for Contact-Rich Manipulation

Dmitriy Kosenkov, Daniia Zinniatullina, Miguel Altamirano Cabrera, Iana Zhura, Mikhail Derevianchenko, Dzmitry Tsetserukou

この論文をやさしく読む

ひとことで言うと

訓練中に触覚センサーから学び、実際に物をつかむときは画像などから接触の変形や力を推定する方法です。つかみ方に応じて、どの程度圧縮するかも予測します。

何に役立つ?

運用時に触覚センサーを搭載しないロボットで、接触状態に応じた把持を行うために役立つ可能性があります。要旨では未見物体や荷重変更を含む実機条件で成功率を評価しています。

この研究の面白いところ

力を推定するだけでなく、接触面の変形と把持ごとの圧縮目標を同時に扱います。状態情報だけの場合に比べ、力の誤差が2.017 Nから0.531 Nに下がりました。

どこまで分かった?

実機の成功率は各条件20試行に基づきます。あらゆる物体や把持条件への一般化を示したものではなく、触覚測定が不要なのは運用時で、訓練時には使用しています。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

信頼性の高いロボット把持には、変化する物理的な相互作用を推定し、把持の仕方に応じた圧縮目標を選ぶことが役立つ。触覚センサーは相互作用を直接測定できるが、運用時に専用のハードウェアを必要とする。本研究では、手首のRGB画像、グリッパーの状態、局所的な重力方向から、密な接触変形、瞬時の6軸の力・モーメント、および把持に応じた望ましい圧縮目標を予測する、触覚教師あり学習の枠組みZeroTouchを提案する。触覚測定は訓練時だけ利用できる特権的な教師情報として用い、運用時には必要としない。 検証データ全体では、完全な構成のモデルにより、法線方向の力の平均絶対誤差(MAE)が、状態情報だけを使うベースラインの2.017 Nから0.531 Nに低下した。各条件20試行の実機評価では、ZeroTouchは未見の物体で95%、既知の物体を未見の把持方法で扱う条件で80%、内容物・荷重が変わる条件で90%の成功率を達成した。同じ評価手順で、OpenVLAの成功率はそれぞれ25%、40%、55%、SmolVLAは10%、25%、35%だった。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-18(UTC)
最新改訂
2026-09-18 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Reliable robotic grasping benefits from estimating the evolving physical interaction and selecting a grasp-dependent compression target. Tactile sensors provide direct interaction measurements but require dedicated hardware at deployment. We introduce ZeroTouch, a tactile-supervised framework that predicts dense contact deformation, the instantaneous six-axis wrench, and a grasp-dependent desired compression target from wrist RGB observations, gripper state, and local gravity direction. Tactile measurements are used only as privileged supervision during training and are not required at deployment. On the full validation set, the complete architecture reduces normal-force MAE from 2.017 N for a state-only baseline to 0.531 N. In physical evaluation with 20 trials per condition, ZeroTouch achieves 95% success on an unseen object, 80% in a seen-object/unseen-grasp condition, and 90% under a content/load shift. Under the same evaluation protocol, OpenVLA achieves 25%, 40%, and 55%, while SmolVLA achieves 10%, 25%, and 35%, respectively.

arXiv ID: 2609.21726 / 要約の誤りについて