状態コスト付きのグラフ上の確率輸送を学習なしで解く
Cost-augmented Schrödinger bridges on graphs are exactly solvable: a Feynman-Kac tilt replaces learned control
この論文をやさしく読む
ひとことで言うと
グラフ上で確率分布を移し替えるとき、途中で通る状態の費用も考える問題を、制御モデルの学習なしで解く方法です。費用を基準となる確率過程に織り込みます。
何に役立つ?
経路上のコストを伴う確率的な輸送や遷移を計算・評価する際に役立ちます。要旨ではタンパク質折り畳みモデルと道路ネットワークでの計算結果が示されています。
この研究の面白いところ
コストを学習時の罰則として後付けする代わりに、参照過程の重み付けとして取り込みます。その結果、両端の分布を交互に合わせる計算に帰着し、収束や誤差の性質も解析できます。
どこまで分かった?
強凸性と残差による誤差評価の説明は、時間平均占有率に関する二次の混雑コストの場合です。道路網での一致はサンプリング誤差の範囲内であり、メモリの線形増加は計算時間の線形増加を意味しません。生体や現実の交通での実験は要旨にありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
グラフ上の一般化シュレーディンガーブリッジは、通過した状態にコストを課しながら、2つの分布の間で質量を移動させる問題である。これまでは、コストを反映させる時間差分ペナルティを用い、制御された連続時間マルコフ連鎖の遷移率を学習する方法が取られてきた。状態コストは、Feynman–Kac型の重み付け変換として参照過程に組み込める。するとコストを加えたブリッジは、変換後の参照過程に対する通常のブリッジとなり、ペナルティは不要になる。 ブリッジは、両端の2つの再スケーリングを交互に行うことで厳密に計算できる。それぞれの再スケーリングは、疎な行列の指数を作用させる1回の計算であり、時間の離散化も学習も行わない。この交互反復の収束率は、両端の結合だけで決まる。時間平均の占有率に関する二次の混雑コストについては、厳密なブリッジを用いた減衰付き最適応答の反復が、強凸関数に対する勾配降下法となり、その残差から誤差を上から抑えられる。 タンパク質折り畳みモデルでは、自由エネルギーのコストによって折り畳み経路の期待障壁が低下する。学習ベースの手法で用いられた道路ネットワークでは、厳密なブリッジから生成した軌跡がサンプリング誤差の範囲内で目標分布と一致し、数百万の交差点を持つネットワークでもメモリ使用量は線形に増加する。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-10-01(UTC)
- 最新改訂
- 2026-10-01 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-10-01 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
The generalized Schrödinger bridge on a graph moves mass between two distributions while charging a cost for the states visited. It has been approached by learning the rates of a controlled continuous-time Markov chain, with a temporal-difference penalty that restores the cost. A state cost folds into the reference process as a Feynman-Kac tilt. The cost-augmented bridge is then a plain bridge against the tilted reference, and the penalty is unnecessary. The bridge is computed exactly by alternating two endpoint rescalings, each one sparse matrix-exponential application; nothing is discretized in time or learned. The alternation converges at a rate set by the endpoint coupling alone. For a quadratic congestion cost on time-averaged occupancies, damped best response around the exact bridge is gradient descent on a strongly convex function, and its residual bounds its error. On a protein-folding model, a free-energy cost lowers the expected barrier of the folding paths. On the learned approach's road network, roll-outs of the exact bridge match the target within sampling error, and on networks with millions of intersections its memory grows linearly.
arXiv ID: 2610.02195 / 要約の誤りについて