arXiv論文メモ
新着一覧
cs.LG / cs.CV · 査読状況未確認

甲状腺細胞診の多倍率分類と不確実性による専門医紹介

TAM-Chain: Multi-Scale Thyroid Cytology Classification via Absorbing Markov Chains and Shannon Entropy Uncertainty Quantification for False-Negative Suppression and Domain-Shift Adaptation

Hai Pham Ngoc

この論文をやさしく読む

ひとことで言うと

甲状腺の細胞画像を複数倍率で調べ、判断が難しい事例を専門家へ回す分類方法を評価した。

何に役立つ?

細胞診の画像解析で偽陰性と分布変化を考慮し、人による確認を組み込む設計の検討材料になる。

この研究の面白いところ

内部235件では偽陰性率0.00%を報告したが、外部1015件ではマクロF1が0.7026となり、環境差の影響も示した。

どこまで分かった?

内部・外部の試験集合での評価であり、臨床現場で患者の診断結果や安全性を改善したことを直接示したものではない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

背景と課題:ベセスダ分類に基づく甲状腺の穿刺吸引細胞診は、甲状腺がんの早期発見に重要である。しかし、深層学習法には、偽陰性率の高さや臨床環境の違いによる分布変化の下での過信という大きな課題がある。方法:本研究は、吸収マルコフ連鎖の理論とシャノンエントロピーに基づく不確実性の定量化を組み合わせ、10倍、20倍、40倍の画像を使う甲状腺細胞診分類の枠組みTAM-Chainを提案する。複数倍率の特徴抽出を吸収確率過程として動的にモデル化し、処理を止める基準と人間の専門家へ回す仕組みを設け、重大な診断誤りを厳しく抑える。 結果:内部試験集合235件で広範に評価した結果、マクロF1は0.9741、絶対偽陰性率は0.00%だった。大きな分布変化がある独立した外部検証集合1015件では、予想される停止段階を適応的に変え、専門家への紹介を起動することで、安定性と分類性能を保ち、マクロF1は0.7026で、単一倍率の比較手法を大きく上回った。結論:著者らはTAM-Chainがデジタル病理の作業手順に有効で安全かつ適応的な解決策となり、自動診断の効率と生物学的な安全性を両立すると結論付けている。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-23(UTC)
最新改訂
2026-09-23 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Background & Problem: Thyroid Fine-Needle Aspiration Biopsy (FNAB) cytology based on the Bethesda System plays a pivotal role in early thyroid cancer detection; however, deep learning approaches face substantial challenges regarding high false-negative rates and overconfidence under clinical domain shift. Methods: In this study, we propose TAM-Chain, a multi-scale (10x, 20x, 40x) thyroid cytology classification framework leveraging Absorbing Markov Chain theory combined with Shannon Entropy-based Uncertainty Quantification. The framework dynamically models multi-magnification feature extraction as an absorbing stochastic process, enabling optimal stopping criteria and a human-in-the-loop referral mechanism to strictly suppress critical diagnostic errors. Results: Extensive evaluation on an internal test set (N = 235) demonstrates a Macro F1 score of 0.9741 with an absolute False-Negative Rate (FNR) of 0.00%. On an independent external validation set (N = 1015) presenting severe domain shift, TAM-Chain maintains superior stability and classification performance (Macro F1 = 0.7026) by adaptively adjusting the expected stopping step and triggering specialist referrals, significantly outperforming single-magnification baselines. Conclusion: The TAM-Chain framework proves to be a highly effective, safe, and adaptable solution for digital pathology workflows, successfully harmonizing automated diagnostic efficiency with stringent biological safety.

arXiv ID: 2609.28590 / 要約の誤りについて