arXiv論文メモ
新着一覧
cs.CL / cs.IR · 査読状況未確認

階層と埋め込み次元を合わせて複数段階の検索を効率化

A Matryoshka Hierarchical RAG for Efficient Multi-Hop Question Answering

Gianluca Bonifazi, Christopher Buratti, Michele Marchetti, Federica Parlapiano, Giulia Quaglieri, Davide Traini, Domenico Ursino, Luca Virgili

この論文をやさしく読む

ひとことで言うと

文書を粗いまとまりから細かいまとまりへ探し、その階層に合わせて埋め込みの次元を変える検索手法です。

何に役立つ?

複数の文書をたどる質問応答で、検索品質を保ちながら索引作成と検索の負担を抑える用途が考えられます。3ベンチマークで比較評価されています。

この研究の面白いところ

文書の意味的な階層と、長さを変えて使える入れ子型の埋め込み表現を対応させています。エンティティを使って探索の回数と候補の順位も調整します。

どこまで分かった?

要旨は7手法との比較での優位性を述べていますが、具体的な品質指標の値、費用削減率、実行時間は示していません。評価された範囲以外への一般化は要旨からは判断できません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

複数段階の推論を要する質問応答(マルチホップQA)向けの検索拡張生成(RAG)システムでは、検索品質と計算コストの両立が必要である。コストは、索引構築時には高価な知識グラフ(KG)や要約生成用の大規模言語モデル(LLM)の利用によって発生し、質問処理時にはLLM主導の反復検索によって発生する。このコストを抑えつつ検索品質を維持するため、RAGとマトリョーシカ表現学習(MRL)を組み合わせる階層型の枠組みMatRAGを提案する。 MatRAGは、クラスタリング構造の意味的階層をMRLの入れ子構造に対応させることで、両種類のコストに対処する。具体的には、文書集合を、粒度が段階的に粗くなるクラスタの有向非巡回グラフ(DAG)として整理する。各階層では、より低いマトリョーシカ埋め込み次元を用いて索引を作る。DAGを上から下へ反復してたどる処理と、ホップ数の予算を制御して候補を再順位付けするエンティティ駆動の仕組みを組み合わせる。 3種類の標準的なマルチホップQAベンチマークで、代表的な7手法を相手にMatRAGを評価した。MatRAGは検索品質で最も強力な競合手法を上回る。さらに、知識グラフ構築とLLMによる要約を不要にすることで索引構築コストを減らし、次元を考慮した類似度計算によって質問処理時のコストも抑える。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-10-01(UTC)
最新改訂
2026-10-01 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Retrieval-Augmented Generation (RAG) systems for multi-hop Question Answering (QA) must balance retrieval quality with computational cost. This cost is incurred during indexing time, through the use of expensive Knowledge Graphs (KGs) or Large Language Models (LLMs) to generate summaries, or during querying, through iterative LLM-driven retrieval. To reduce it while maintaining retrieval quality, we present MatRAG, a hierarchical framework that combines RAG systems with Matryoshka Representation Learning (MRL). MatRAG addresses both kinds of cost by aligning the semantic hierarchy of a clustering structure with the nested structure of MRL. Specifically, it organizes the corpus of documents into a Directed Acyclic Graph (DAG) of clusters with progressively coarser granularity. Each level is indexed by a lower Matryoshka dimension. MatRAG pairs an iterative, top-down traversal of the DAG with an entity-driven mechanism that controls the hop budget and re-ranks candidates. We evaluated MatRAG on three standard multi-hop QA benchmarks against seven representative baselines. MatRAG outperforms its strongest competitors in terms of retrieval quality; furthermore, it reduces indexing costs by avoiding KG construction and LLM-based summarization, and lowers query-time costs through dimension-aware similarity.

arXiv ID: 2610.01767 / 要約の誤りについて