arXiv論文メモ
新着一覧
cs.AI · 査読状況未確認

漢方知識グラフの信頼度を考慮した検索基盤

TCMaster: Confidence-Aware Querying and Workload-Guided Physical Design for Multi-Source Traditional Chinese Medicine Knowledge Graphs

Zheng Chen, Yuzhu Li, Haoxuan Li, Zhongde Zhang, Lianshun Jin and Peiwu Qin

この論文をやさしく読む

ひとことで言うと

伝統中国医学の知識グラフで、情報源の信頼度を踏まえて検索する仕組みを提案した。

何に役立つ?

複数情報源を統合した知識グラフの検索速度や回答精度を改善する設計に役立つ可能性がある。医学的な診断効果を示す結果ではない。

この研究の面白いところ

経路の信頼度評価と探索方向・短絡エッジの工夫を組み合わせ、検索速度と質問応答の正解率を同時に評価した。

どこまで分かった?

数値はNeo4j上の評価とTCMbenchの質問応答で得られた。臨床利用時の正確さや安全性は要旨からは分からない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

複数の情報源から作る知識グラフ(KG)には、情報の信頼性を示し、分野固有の構造を活用する検索方法が必要である。本稿は、伝統中国医学のKGを対象に、信頼度を考慮したグラフの探索と、検索負荷に合わせたデータ配置を行うプロパティグラフ基盤TCMasterを提示する。薬局方、処方、分子データベース、大規模言語モデルで抽出した細かな意味情報を統合し、約22万1000のエンティティと72万3000の基本エッジを持つKGを構築する。各エッジに出典に応じた信頼度を付け、Cypherクエリを信頼度条件で書き換え、複数のエッジをたどる経路を積・最小値・加重平均の方針で順位付けする。また、オントロジー内の分布の偏りを、探索方向の選択、生薬属性のビットマップ、事前計算した短絡エッジで利用する。Neo4j上では、方向選択によって属性検索が1.47倍高速化し、短絡エッジによって多数の接続先を持つ対象の件数計算が4.42倍高速化した。信頼度による絞り込みは、質の低い異種の経路を39.3%除去し、KG検索を使ったTCMbenchの質問応答正解率は20.0パーセントポイント向上した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-22(UTC)
最新改訂
2026-09-22 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Multi-source knowledge graphs (KGs) need query mechanisms that expose reliability and exploit domain structure. This paper presents TCMaster, a property-graph query substrate for confidence-aware traversal and workload-guided physical design over Traditional Chinese Medicine KGs. TCMaster integrates pharmacopoeias, prescriptions, molecular databases, and LLM-extracted micro-semantics into a KG with approximately 221K entities and 723K base edges. It annotates edges with provenance-level confidence, rewrites Cypher queries with confidence predicates, ranks multi-hop paths under PRODUCT, MIN, or weighted-average policies, and uses ontology skew through direction selection, herb-attribute bitmaps, and materialized shortcut edges. On Neo4j, direction selection improves attribute lookup by a factor of 1.47, shortcuts accelerate high-fanout target counting by a factor of 4.42, confidence filtering removes 39.3 percent of low-quality heterogeneous paths, and KG retrieval improves TCMbench QA accuracy by 20.0 percentage points.

arXiv ID: 2609.25712 / 要約の誤りについて