arXiv論文メモ
新着一覧
cs.CV / cs.LG · 査読状況未確認

乳房画像分類で局所と全体の特徴を組み合わせるM3D-Net

M3D-Net: Hierarchical Coordination of Spatial Context, Feature Reuse, and Differential Attention for Mammography Classification

Zheng Yu, Xinhang Li, Jiabao Gao, Boyang Wang, Xiang Li

この論文をやさしく読む

ひとことで言うと

乳房画像の細かい特徴と全体の形を同時に利用する画像分類モデルを提案し、二つの画像データで比較した研究です。

何に役立つ?

乳房画像の分類モデルを設計する際、特徴の再利用や注意機構の配置を検討する参考になります。臨床診断での有効性は別途検証が必要です。

この研究の面白いところ

初期特徴の再利用、座標を考慮した局所・全体の統合、粗い解像度での差分注意を階層的に組み合わせています。

どこまで分かった?

要旨自身が、乱数の種を変えた反復、構成要素を統制した比較、独立評価を今後の必要事項としています。報告値は検証精度であり、臨床での性能を示すものではありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

乳房画像の分類には局所的な細部と組織全体の文脈が必要だが、表現を深くするにつれてこれらの手掛かりが弱まることがある。本研究は、解像度に応じて演算を配置し、複数尺度の座標注意機構、範囲を制限した動的な特徴再利用、差分注意機構を階層的に組み合わせるマンモグラフィー用エンコーダー M3D-Net を提示する。段階内での特徴の取り出しによって初期の特徴を利用し続け、座標を考慮した集約が局所と全体の文脈を統合し、差分注意機構は粗い解像度で働く。AISSLab のマンモグラフィーでは画像だけによる分類を、BrEaST の超音波では適応した画像・臨床情報モデルを評価した。EdgeNeXt、RepViT、TransXNet と比較し、提案した実装は記録された検証精度と学習後半の精度が最も高く、最終時点の交差エントロピー損失が最も低かった。検証精度はそれぞれ97.78%と80.39%に達した。これらの結果は乳房画像の異なる設定で階層的な協調をさらに評価する根拠になるが、乱数の種を変えた反復、構成要素を統制した比較、独立した評価はなお必要である。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-23(UTC)
最新改訂
2026-09-23 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Breast image classification requires local detail and global tissue context, yet these cues can weaken as representations deepen. We present M3D-Net, a mammography encoder that hierarchically coordinates multi-scale coordinate attention, bounded dynamic feature reuse, and differential attention through resolution-aware operator placement. Within-stage retrieval preserves access to earlier features, coordinate-aware aggregation integrates local and global context, and differential attention operates at coarse resolutions. We evaluate image-only classification on AISSLab mammography and an adapted image--clinical model on BrEaST ultrasound. Against EdgeNeXt, RepViT, and TransXNet, the proposed implementations achieve the highest recorded validation accuracy and late-training accuracy, with the lowest endpoint cross-entropy loss. Validation accuracies reach 97.78\% and 80.39\%, respectively. These results support further evaluation of hierarchical coordination across breast imaging settings; repeated-seed, component-controlled, and independent evaluations remain necessary.

著者のコメント

Submitted to IEEE ICASSP 2027; 5 pages, 4 figures

arXiv ID: 2609.27523 / 要約の誤りについて