arXiv論文メモ
新着一覧
cs.CL · 査読状況未確認

文書更新で知識の変更と文章の変更を分けて記録

Knowledge Pull Requests for Continual Document Authoring

Alexander Martin, Benjamin Van Durme

この論文をやさしく読む

ひとことで言うと

文書を更新するとき、新しく加える事実と実際に書き換える文章を分け、どの変更が何のためか追えるようにする方法です。

何に役立つ?

考えられる用途は、複数言語や新しい資料を参照しながら、既存の説明を保って文書を更新する作業です。変更理由と文章差分を別々に確認できます。

この研究の面白いところ

単なる差分表示に加え、主張の選別、節への振り分け、既存内容との矛盾の指摘を一連の処理にしています。多言語の知識を文書へ取り込む評価も行っています。

どこまで分かった?

結果はWikipedia改訂とRAGTIMEの評価に基づきます。検索付きモデルとの比較は、その設定で他言語の知識が現れなかったという結果で、検索一般が多言語知識を取得できないという主張ではありません。要旨には改善量の数値はありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

文書を継続的に執筆・更新し、各変更を解釈できるようにする枠組み、Knowledge Pull Requests(KPR)を導入する。文書は、別の情報源、言語、時期から新たな知識が現れるたびに改訂が必要になる。しかし既存手法は、何の知識が変わったかを説明せずに編集するか、最初から生成し直すかのいずれかである。KPRは、主張を抽出し、選別して適切な節へ振り分け、既存内容との矛盾を示すことで、新しい知識を文書に統合する。そして、何の知識が変わるかを示す主張の提案と、文章がどう変わるかを示す文書差分とを分けたChangeLogを生成する。 言語間でのWikipedia改訂と、RAGTIMEにおける質問に基づく報告書の更新でKPRを評価する。情報源から書き直す方法や最初から再生成する方法に比べ、KPRはより多くの情報を統合し、既存内容をよりよく保持するとともに、生成トークン当たりに追加する情報量が最も多い。KPRで改訂した記事は、検索を備えた最先端モデルよりも、質問応答の根拠として優れていた。比較対象のモデルでは、他言語だけに記録された知識が検索で現れなかった。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-22(UTC)
最新改訂
2026-09-22 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

We introduce Knowledge Pull Requests (KPRs), a framework for continual document authoring that makes each change interpretable. Documents require ongoing revision as new knowledge surfaces from other sources, languages, or times, but existing approaches either edit with no account of what knowledge changed or regenerate from scratch. A KPR integrates new knowledge into a document by extracting claims, filtering and routing them to sections, and flagging conflicts with existing content, producing a ChangeLog that separates what knowledge changes (claim proposal) from how the text changes (document diff). We evaluate KPRs on revising Wikipedia across languages and updating query-driven reports on RAGTIME. KPRs integrate more information and better preserve existing content than rewriting from sources or regenerating from scratch, while adding the most information per token generated. A KPR-revised article also grounds question answering better than a frontier model with search, which does not surface knowledge documented only in other languages.

著者のコメント

Code: https://github.com/alexmartin1722/kpr

arXiv ID: 2609.26634 / 要約の誤りについて