医療画像の領域分割を軽量化する学習方法
GAD-MambaUNet: Direction-Group Mamba with Gradient-Adaptive DINOv3 Distillation for Lightweight Medical Image Segmentation
この論文をやさしく読む
ひとことで言うと
医療画像の部位を塗り分ける小型モデルに、方向間の情報交換と大きな教師モデルからの学習を組み合わせています。
何に役立つ?
計算資源に制約がある環境で医療画像の領域分割を行うための設計に役立つ可能性があります。
この研究の面白いところ
大きな教師モデルは学習時に利用し、その教えをどれだけ強く反映するかも動的に調整する点です。
どこまで分かった?
要旨には精度や計算量の具体的な数値、評価データの詳細はありません。多クラス・多モダリティへの拡張は今後の課題で、臨床的な効果を示した結果ではありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
本研究では、効率的な局所モデリング、方向・グループ間の状態空間相互作用、学習時の基盤モデルによる教師信号を組み合わせた、軽量な医療画像セグメンテーションネットワークGAD-MambaUNetを提案する。小型のセグメンテーションネットワークで文脈のモデル化を改善するため、Direction-Group Graph Selective Scan(DG-GSS)を導入した。これは走査方向とチャネルグループの応答をグラフのノードとして扱い、複数方向の情報を融合する前に構造化された情報交換を可能にする。 さらに、凍結したDINOv3教師モデルが学習時に意味的な指針を与え、Gradient-Adaptive Distillationが蒸留の強度を動的に調整するDINOv3-GADの教師信号を取り入れた。GAD-MambaUNetは、代表的な軽量手法および汎用のセグメンテーション手法と比べて、精度と効率の良好なバランスを達成する。アブレーション研究によって、DG-GSSと学習時のDINOv3-GAD教師信号の有効性も確認した。今後は、より柔軟な教師・生徒の整合方法を検討し、多クラスや多モダリティのセグメンテーションなど、より多様な医療画像の領域分割へ提案枠組みを拡張する。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-22(UTC)
- 最新改訂
- 2026-09-22 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-22 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
In this paper, we proposed GAD-MambaUNet, a lightweight medical image segmentation network that combines efficient local modeling, direction--group state-space interaction, and training-time foundation-model supervision. To improve contextual modeling in compact segmentation networks, we introduced Direction-Group Graph Selective Scan (DG-GSS), which treated scan-direction and channel-group responses as graph nodes and enabled structured information exchange before multi-directional fusion. We further incorporated DINOv3-GAD supervision, where a frozen DINOv3 teacher provided semantic guidance during training, and Gradient-Adaptive Distillation dynamically regulated the distillation strength. GAD-MambaUNet achieves a favorable accuracy--efficiency balance compared with representative lightweight and general segmentation methods. Ablation studies further verify the effectiveness of DG-GSS and training-time DINOv3-GAD supervision. In future work, we will explore more flexible teacher--student alignment strategies and extend the proposed framework to more diverse medical segmentation scenarios, such as multi-class and multi-modal segmentation tasks.
arXiv ID: 2609.26729 / 要約の誤りについて