arXiv論文メモ
新着一覧
cs.CV / cs.AI · 査読状況未確認

画像種別をまたぐモデルと専門モデルで希少病変を検出

Generalist-Specialist Mixture-of-Experts for Rare Pathology Detection in Multimodal Imaging

Johannes Kaiser, Florian Braunmiller, Daniel Rückert, Georgios Kaissis

この論文をやさしく読む

ひとことで言うと

画像の種類ごとに分かれた専門モデルに、複数の種類を横断して学ぶ汎用モデルを組み合わせ、まれな病変を見つけやすくする方法です。

何に役立つ?

頻度の高い病変に偏らず、低頻度の病変についても画像分類性能を評価・改善する設計の参考になります。

この研究の面白いところ

全体指標の小幅な改善に加え、従来モデルがF1でゼロだった6病変の検出が改善しています。共有する知識を残す効果に注目しています。

どこまで分かった?

結果はRadImageNet上の評価です。臨床現場での有効性を実証したものとは記載されていません。53%削減は推論時の稼働パラメータ数であり、総パラメータ数や実測処理時間の削減率ではありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

複数モダリティの医用画像を扱うAIモデルは、モダリティ固有の専門化と、モダリティをまたぐ共有表現の両立が必要だが、純粋なMixture-of-Experts(MoE)アーキテクチャは現状このトレードオフに対応できていない。エキスパートに基づく振り分けは、同じドメイン内の学習を改善する一方、モダリティ横断の信号を損なう可能性がある。本研究の実験では、その信号が特に希少な、出現頻度の低い病変に重要であることがうかがえる。 そこで、モダリティ横断の汎用モデルと、モダリティごとに異なる専門モデルを、ドメイン制約付きの特徴融合によって結合する二分岐MoEアーキテクチャ、Generalist-Specialist-MoE(GS-MoE)を導入する。 RadImageNet(135万画像、165種類の病変、3モダリティ)において、GS-MoEは、すべてのベースラインがF1 = 0となる6種類の低頻度病変の検出を可能にし、クラスごとのF1の向上は最大+0.60に達した。さらに、密なモデルと専門モデルのみのMoEによるベースラインを集計性能でもわずかに上回り、MCCは0.770だった。同時に、調査した中で最も強力な密なモデルより、推論時に動作するパラメータ数を約53%削減した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-16(UTC)
最新改訂
2026-09-16 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

AI models for multimodal medical imaging must balance modality-specific specialization with cross-modal shared representations, a trade-off that pure Mixture-of-Experts (MoE) architectures currently fail to satisfy. Expert-based routing improves in-domain learning but may sacrifice cross-modal signals, which appear particularly important for rare (low-prevalence) pathologies in our experiments. To resolve this, we introduce Generalist-Specialist-MoE (GS-MoE), a two-branch (MoE) architecture that couples a cross-modal generalist model with distinct modality-specific specialists (experts) via domain-constrained feature fusion. On RadImageNet (1.35M images, 165 pathologies, three modalities), GS-MoE recovers detection of six low-prevalence pathologies on which every baseline scores F1 $=$ 0, with per-class gains up to +0.60 F1. It attains this while even slightly exceeding dense and specialist-only MoE aggregate baselines (MCC 0.770), while using ${\sim}53\%$ fewer active parameters at inference than the strongest investigated dense model.

arXiv ID: 2609.18688 / 要約の誤りについて