arXiv論文メモ
新着一覧
cs.CL · 査読状況未確認

モデルのトークン数に合わせた文章分割と回答選択

ChunkRank: Model-Aware Text Chunking and Abstention-Aware Answer Selection for LLM Pipelines

Amit Nautiyal, Ayush Bhatt, Gaurav Nautiyal

この論文をやさしく読む

ひとことで言うと

モデルごとのトークン数に合わせて長文を分け、部分ごとの回答から採用するものを選ぶライブラリの研究です。

何に役立つ?

考えられる用途は、文脈窓に入りきらない文章への質問応答です。要旨では小さな窓や窓を超える設定を主な対象としています。

この研究の面白いところ

回答候補を複雑に順位付けしても、最初の空でない回答を安定して上回れなかったという否定的な結果も示しています。

どこまで分かった?

比較したのは記載された3つの質問応答データセットと読み取り方式です。あらゆる課題で単純な選択法が最善だとは示していません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

ChunkRankは、対象モデルのトークナイザーと文脈窓から文章の分割位置を決め、各部分について独立に生成された回答候補から一つを選ぶ、オープンソースのPythonライブラリである。15の提供元にまたがる90モデルの検証済み登録情報と、6種類の回答選択法を備え、必要な主要依存ライブラリは3つだけである。 文章分割では、モデル名から文脈窓の超過を自動で避ける。文字数に基づく分割では窓を超えたり、使える容量を無駄にしたりするのに対し、11言語にわたる忠実度の調査は、英語以外でもトークン数を正確に見積もる重要性を示した。一方、回答選択では否定的な結果が得られた。NaturalQuestions、TriviaQA、HotpotQAにおいて、抽出的および生成的な読み取りモデルを用いた場合、回答の内容に基づく順位付けのどれも、最初の空でない回答を採用する方法を安定して上回らなかった。原因は回答の位置ではなく、答えを含まない部分に対して読み取りモデルが回答を控えることにある。長い文脈を一度に読む比較手法からは、一段階で答えられる質問では分割処理が単一回の読み取りに匹敵することが分かった。このためChunkRankは、文脈窓が小さい場合や文章が窓を超える場合を対象とする。コード、モデル登録情報、評価用の仕組みを公開している。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-24(UTC)
最新改訂
2026-09-24 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

We present ChunkRank, an open-source Python library that derives chunk boundaries from a target model's tokenizer and context window, and selects an answer among candidates produced independently per chunk. It ships a validated registry of 90 models across 15 providers and six answer-selection methods, and needs only three core dependencies. For chunking, ChunkRank avoids context-window overflow automatically from the model name, whereas character-based splitters overflow or waste the budget, and a fidelity study across 11 languages shows why token-exact budgets matter beyond English. For answer selection we report a negative result: on NaturalQuestions, TriviaQA and HotpotQA, with extractive and generative readers, no content-based ranker reliably beats taking the first non-empty answer. The reason is reader abstention on chunks that lack the answer, not answer position. A long-context baseline shows that chunking matches single-call reading on single-hop questions, so ChunkRank targets small-window and beyond-window settings. Code, registry and evaluation harness are released.

著者のコメント

16 pages. Code: https://github.com/AmitoVrito/chunkrank

arXiv ID: 2609.29828 / 要約の誤りについて