反復型言語モデルで答えが変わらず得点だけ動く理由
Prediction Dynamics in Depth-Recurrent Language Models
この論文をやさしく読む
ひとことで言うと
同じ答えを出し続けながら内部の得点を更新する言語モデルについて、どんな動きなら答えが入れ替わらないかを分析しています。全候補の得点が一緒に動く場合と、候補間の優劣が変わる場合を分けます。
何に役立つ?
反復計算が回答の選択にどれだけ影響するかを理解するのに役立ちます。考えられる用途は停止条件の検討ですが、要旨の比較自体は計算を最後まで行った後の分析です。
この研究の面白いところ
更新が大きくても、全候補が同じ方向に動けば順位は変わりません。更新量だけでなく方向と候補ごとの得点差を見ることで、答えが保たれる条件をより細かく捉えています。
どこまで分かった?
22.5~34.4%は、完了済み軌跡で判定した最初の適合深さの変化を全深さに対して表した値です。実運用で同じ割合の計算時間を削減したという結果ではなく、評価モデルはHuginn-3.5BとOuro-1.4Bです。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
深さ方向に反復する言語モデルは、潜在状態を繰り返し更新して予測を洗練する。途中の答えが最終的な答えと一致していても、その得点が変わり続けるのはなぜだろうか。本研究では、鋭いマージンの特徴づけを導き、更新の大きさに基づく上界がどれほど保守的かを、共通の平行移動、勝者に対する更新方向、各競合候補の更新と得点差の組合せに分解する。 Huginn-3.5BとOuro-1.4Bにおいて、回答文全体を採点する場合、更新方向と競合候補との対応を考慮すると、共通の平行移動を除くだけの場合に比べ、条件を最初に満たす平均深さが、全深さの22.5~34.4%に相当する分だけさらに浅くなる。この比較は、完了済みの実行軌跡を用いた事後的なものである。ラベルを採点する場合にも、これらの要素は大きく寄与する。 共通の予測分布を用いる場合について、共通の動きと候補間の差を変える動きを直交的に分離し、共通成分を候補集合に割り当てられた確率質量と集合内の集中度によって表現する。共通成分と対比成分のエネルギーは異なる速さで減衰しうるため、選好の変化が占める割合の増大と、更新量の絶対値の縮小は両立する。これらの知見は、観測された得点変化の幾何学と成分構成を通じて、有限の深さで答えが維持される仕組みを説明する。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-18(UTC)
- 最新改訂
- 2026-09-18 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-18 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Depth-recurrent language models refine predictions through repeated latent updates. Why can intermediate answers agree with the endpoint while their scores continue to change? We derive a sharp margin characterization that decomposes the conservatism of a magnitude bound into common translation, direction relative to the winner, and the pairing of each competitor's update with its score gap. Across Huginn-3.5B and Ouro-1.4B, accounting for update direction and competitor pairing reduces the mean earliest qualifying depth by a further 22.5-34.4% of the total depth beyond translation removal under full answer-text scoring. This retrospective comparison uses completed trajectories. Substantial contributions also occur under label scoring. For shared predictive distributions, we separate common and contrast motion orthogonally and express the common component through candidate-set mass and within-set concentration. Common and contrast energies can attenuate at different rates, allowing a growing preference-change share to coexist with shrinking absolute updates. These findings explain finite-depth answer preservation through the geometry and composition of observed score changes.
arXiv ID: 2609.21383 / 要約の誤りについて