arXiv論文メモ
新着一覧
q-bio.GN / cs.AI / cs.CL · 査読状況未確認

文献の根拠を確認して遺伝性疾患の重症度を分類するAI

Large Language Model Agents for Evidence Based Genetic Disease Severity Classification

Tohid Ghasemnejad, Ahmadreza Argha, Mark Grosser, John Wang, Min Yang, Thantrira Porntaveetus, Tony Roscioli, Nigel H. Lovell, Mahmoud Aarabi, Hamid Alinejad-Rokny

この論文をやさしく読む

ひとことで言うと

遺伝性疾患の症状がどの程度重いかを、医学文献と既存基準に照らして分類するAIです。

何に役立つ?

遺伝子検査パネルに含める対象を検討する際、重症度判断とその根拠を整理する作業の支援が考えられます。

この研究の面白いところ

分類の正解率だけでなく、生成した説明が文献の証拠や妥当な推論で支えられる割合も評価しています。

どこまで分かった?

報告値は分類や既存リストとの一致に関する評価で、患者の診断精度や健康改善を示す値ではありません。要旨は遺伝子レベルで集約した8,738組の組み合わせの定義を詳述していません。

v2のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

遺伝性疾患の重症度分類は主観的で多くの手間を要し、市販検査パネルの規模や収録対象の重なりが大きく異なるゲノムスクリーニングの障害となっている。本研究では、推論と行動を組み合わせるReActと検索拡張生成(RAG)を統合し、Human Phenotype Ontologyの10,211用語を分類する自律型AIエージェントを開発した。米国臨床遺伝・ゲノム学会(ACMG)が支持する重症度ガイドラインと、米国産科婦人科学会(ACOG)の生活の質に関する基準を用いてPubMed文献を検索し、解釈可能な推論の連鎖を生成するとともに、主張を独立に検証する。 専門家が整備したコホートを用いた表現型レベルの評価では、正解率93.55%、Matthews相関係数(MCC)0.9237を達成し、主張の82.6〜91.4%が直接的証拠または妥当な推論で支持された。8,738組について遺伝子レベルの重症度を集約し、重度または最重度の症状を示す常染色体劣性の組を3,283組特定した。外部検証では、Mackenzie’s Missionの遺伝子リストとの一致率は95.2%だった。このシステムは、直接的証拠に裏付けられた信頼性のある自動分類を提供することで、検査パネル設計の標準化を可能にする。

v2の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-17(UTC)
最新改訂
2026-09-18 · v2
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Disease severity classification for genetic conditions is subjective and labor-intensive, creating bottlenecks in genomic screening, where commercial panels vary widely in size and overlap. We developed an autonomous AI agent integrating Reasoning and Acting (ReAct) with Retrieval-Augmented Generation (RAG) to classify 10,211 Human Phenotype Ontology terms. It uses American College of Medical Genetics (ACMG)-endorsed severity guidelines and American College of Obstetricians and Gynecologists (ACOG) quality-of-life criteria to retrieve PubMed literature, generate interpretable reasoning chains, and independently verify claims. At the phenotype level, using expert-curated cohorts, the agent achieved 93.55% accuracy (MCC 0.9237) with 82.6% to 91.4% of claims supported by direct evidence or valid inferences. Gene-level severity was aggregated across 8,738 pairs, identifying 3,283 autosomal recessive pairs with severe or profound presentations. External validation showed 95.2% concordance with Mackenzie's Mission gene list. This system enables standardized panel design by providing reliable, automated classification supported by direct evidence.

arXiv ID: 2609.19569 / 要約の誤りについて