中医学の処方生成で推論過程と禁忌規則を扱う手法
Syndrome, Synergy, and Safety: Structured Reasoning and Knowledge-Driven Alignment for TCM Prescription Generation
この論文をやさしく読む
ひとことで言うと
中医学の処方を生成するモデルに、診断の理由、経過に応じた変更、配合禁忌の規則を取り入れる研究。
何に役立つ?
中医学の処方生成モデルで、説明可能性と禁忌規則を評価する方法の検討に役立つ。
この研究の面白いところ
四段階の追加学習を組み合わせ、70億パラメーターのモデルが三つの評価指標でゼロショットGPT-5を上回った。
どこまで分かった?
要旨はモデル評価指標の改善を示すが、患者に用いたときの安全性や治療効果を実証したとは述べていない。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
中医学の処方生成に大規模言語モデルを使う場合、臨床上重要な三つの不足がある。第一に、理・法・方・薬の枠組みに従う検証可能な推論過程を示さず、入力から直接処方へ対応付ける。第二に、各診療を単独で扱い、証に応じた加減による追跡時の調整を行わない。第三に、十八反のような絶対的な配合禁忌を強制しない。本研究は、教師あり微調整(SFT)、PG-CoT、動的なSFT、知識に基づく強化学習(K-RL)という四段階の枠組みを提案し、これらに対応する。PG-CoTは理・法・方・薬の枠組みで思考過程の蒸留を制約し、検証可能な診断の連鎖を作る。動的なSFTは状態遷移の理由を明示して患者の経過をモデル化し、K-RLは決定的な薬理規則を規則ベースのDPO選好信号として組み込む。追加学習した12モデルとゼロショットの六つの基準モデルを比較すると、この枠組みはゼロショットの基準より処方の品質を大きく改善した。70億パラメーターのMistral-7Bモデルは、中医学の三つの評価指標すべてでゼロショットのGPT-5を上回った。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-22(UTC)
- 最新改訂
- 2026-09-22 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-22 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Applying large language models to Traditional Chinese Medicine (TCM) prescription generation reveals three clinically critical gaps: models produce end-to-end mappings without auditable reasoning following the li-fa-fang-yao paradigm (SR Gap), treat each encounter in isolation without follow-up adjustment via sui zheng jia jian (LA Gap), and fail to enforce absolute contraindication rules such as Shi Ba Fan (SC Gap). We propose a progressive four-stage framework (SFT $\to$ PG-CoT $\to$ Dynamic $\to$ K-RL) that addresses each gap: PG-CoT constrains CoT distillation under the li-fa-fang-yao paradigm to produce auditable diagnostic chains, Dynamic SFT models patient trajectories with explicit transition reasoning, and K-RL encodes deterministic pharmacological rules as rule-based DPO preference signals. Across 12 fine-tuned models and 6 zero-shot baselines, our framework substantially improves prescription quality over zero-shot baselines---with a 7B model (Mistral-7B) surpassing zero-shot GPT-5 on all three TCM evaluation metrics.
著者のコメント
21pages, 6figures
arXiv ID: 2609.25755 / 要約の誤りについて