arXiv論文メモ
新着一覧
cs.IR · 査読状況未確認

質問の難しさに合わせて知識グラフの探索を切替

Asymmetric Dynamic Routing: Balancing Reasoning Depth and Computational Efficiency in Hypergraph RAG

Qi Sun, Yijia Zhang, Xingliang Hou, Caibo Li, Qiang Li, Yu Guo

この論文をやさしく読む

ひとことで言うと

質問の内容に合わせ、知識グラフをたどる方法を三種類から選び、検索の無駄を減らします。

何に役立つ?

知識グラフを使うRAGで、質問ごとの計算量と必要な文脈の取得を調整する方法として考えられます。

この研究の面白いところ

局所的な事実、下から上、上から下という三つの探索を切り替え、5コーパスでトークンを最大48.7%、遅延を45.3%減らしました。

どこまで分かった?

結果は要旨にある五つの分野別コーパスでの評価です。トークン削減率は最大値であり、すべての質問で同じ削減が得られるわけではありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

グラフやハイパーグラフを使う検索拡張生成(RAG)は大規模言語モデルの誤った生成を大幅に減らす一方、既存の構造化RAGは質問の複雑さにかかわらず、固定された探索方法を使うことが多い。著者らは、この「固定検索の誤り」が、簡単な質問では計算の重複を、複雑な推論課題では必要な文脈の欠落を引き起こす主な原因だと捉える。推論の質と推定時の効率を両立するため、階層的な知識グラフ上で質問の意図に応じて動く、非対称動的ルーティング(ADR)を提案する。 ADRは軽量な構造化分類器を使い、質問を三種類の非対称なグラフ探索操作へ動的に振り分ける。操作は、局所的な事実への固定、下から上への隣接関係の拡散、上から下への見通しの裏付けであり、階層的な知識の層を上下両方向に情報が流れるようにする。分野別の五つのコーパスで広範な実験を行い、ADRは強い推論性能を維持しながら、プロンプトに使うトークンを最大48.7%、質問全体の処理遅延を45.3%減らした。これにより、質問に応じて検索を変えるハイパーグラフRAGで、品質と効率の良い均衡を示した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-24(UTC)
最新改訂
2026-09-24 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

While graph-based and hypergraph-based Retrieval-Augmented Generation (RAG) significantly mitigate hallucinations in Large Language Models (LLMs), existing structure-based RAG systems typically adopt static traversal strategies regardless of the query complexity. We identify this ``static retrieval fallacy'' as a primary source of computational redundancy for simple queries and cognitive context gaps for complex reasoning tasks. To balance reasoning quality and inference efficiency, we propose Asymmetric Dynamic Routing (ADR), an intent-conditioned retrieval framework operating over hierarchical knowledge graphs. ADR employs a lightweight structured classifier to dynamically dispatch queries among three asymmetric topological traversal operators: localized fact anchoring, bottom-up adjacency diffusion, and top-down insight grounding, which collectively enable bidirectional information flow across hierarchical knowledge layers. Extensive empirical evaluations across five domain-specific corpora demonstrate that ADR maintains strong reasoning performance while reducing prompt token consumption by up to 48.7\% and end-to-end query latency by 45.3\%, yielding a favorable quality--efficiency trade-off for query-adaptive Hypergraph RAG.

著者のコメント

5 pages, 1 figures. Preprint

arXiv ID: 2609.29282 / 要約の誤りについて