arXiv論文メモ
新着一覧
cs.RO · 査読状況未確認

顕微鏡の単眼映像から微小電極の輪に針を通す

MicroHookACT: Monocular Microscopic Vision Guided Visuomotor Policy for Flexible Microelectrode Hooking

Yitong Chen, Fangbo Qin, Yang Wang, Ruihua Hu, Kui Zhang, Shan Yu

この論文をやさしく読む

ひとことで言うと

顕微鏡の映像を見て、細い針を微小な輪に通す動作を人の実演から覚えるロボット制御です。ピンぼけも奥行きを知る手掛かりに使います。

何に役立つ?

考えられる用途は、柔軟な微小電極の埋め込み工程の一部を自動化することです。実証されたのは五つの実験設定における引っ掛け操作です。

この研究の面白いところ

画像への手作業の印付けを使わず、実演の行動情報から見るべき場所を学習します。動作の進行に合わせて全体を見る特徴と細部を見る特徴の重みを変えます。

どこまで分かった?

成功率96.7%と平均11.5秒は、60件の実演で学習した方策を指定の五設定で評価した結果です。要旨は患者への埋め込みや臨床上の安全性を検証したとは述べていません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

柔軟な微小電極(FME)の埋め込みでは、針をループに引っ掛ける操作の自動化が重要な工程となる。本論文では、単眼顕微鏡の視覚情報の下で3次元の引っ掛け操作を自動化する、模倣学習に基づく視覚運動方策MicroHookACTを提示する。まず、一方向の引っ掛け戦略がピンぼけの手掛かりと光軸に沿った誘導を利用し、探るような接触を行わずに精密な位置合わせを可能にするとともに、多くの接触を伴う糸通し操作を実現する。次に、凍結したViTを基盤とする行動教師付きの物体注意モジュールが、人の実演から微小針の先端と微小ループに直接注目することを学ぶため、学習用の手作業による視覚アノテーションを必要としない。さらに、注意の中心に基づく大域的で粗い特徴と局所的で細かい特徴を、予測した動作の進行度に応じて動的に重み付けする。これにより、一つのACT方策が、操作全体を通じて変化するピンぼけと視覚情報の要求に適応できる。 実験では、60件の人の実演で視覚運動方策を学習し、難易度の異なる五つの設定で評価した。MicroHookACTは全体成功率96.7%で最も高い成績を達成し、平均実行時間は11.5秒だった。これらの結果は、動作条件が変化する状況でのミクロンレベルの制御に、視覚運動方策の学習が有望であることを示している。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-18(UTC)
最新改訂
2026-09-18 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Automated needle-loop hooking is a critical step in flexible microelectrode (FME) implantation. This paper presents MicroHookACT, an imitation learning-based visuomotor policy for automated 3D hooking under monocular microscopic vision. First, a unidirectional hooking strategy exploits defocus cues and optical-axis guidance to enable palpation-free precise alignment and contact-rich threading. Second, an action-supervised object attention module built on a frozen ViT backbone learns to focus on the micro-needle tip and micro-loop directly from human demonstrations, without requiring manual visual annotations for training. Third, attention-centered global coarse and local fine features are dynamically weighted according to predicted action progress, enabling a single ACT policy to adapt to changing defocus blur and visual requirements throughout the operation. In the experiments, visuomotor policies were trained on 60 human demonstrations and evaluated under five setups with varying difficulties. Our MicroHookACT framework achieved the highest overall success rate of 96.7\% with an average execution time of 11.5 s. These results demonstrate the potential of visuomotor policy learning for micron-level control under varying operating conditions.

arXiv ID: 2609.21365 / 要約の誤りについて