標本から解く制御アフィン最適制御の確率的最適化
A Stochastic Optimization Approach to Control-Affine Optimal Control Problems
この論文をやさしく読む
ひとことで言うと
動きの法則や費用を標本からしか得られない最適制御問題を、確率的な最適化で解くための理論。
何に役立つ?
制御器を学習する途中でも、その性能の上界を計算して評価する方法として役立つ可能性がある。ただし追加の正則性が必要。
この研究の面白いところ
同じ問題から双対、主、主双対の3形式を導き、確率的一次法の最適値への収束と、途中の制御器の性能評価を扱う。
どこまで分かった?
実証は簡単な制御問題での予備的結果にとどまる。収束には一般的な条件が、性能上界には追加の正則性が必要とされる。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
本研究は、ダイナミクスと費用関数に標本を通じてしかアクセスできない、トーラス上の制御アフィンな最適制御問題を扱う。この問題の弱形式から出発し、確率的最適化と両立する双対形式、主形式、主双対形式を導く。一般的な条件の下で、確率的一次法が最適値へ収束することを示す。 さらに、追加の正則性の仮定の下で、最適化の途中に得られる準最適な制御器の性能に上界を与える、計算可能な尺度を導入する。予備的な結果では、この方法によって簡単な制御問題を効率よく解けることを示した。最後に、主形式と主双対形式にとって重要な仮定である、最適な占有測度の有界性が成り立つ条件を議論する。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-24(UTC)
- 最新改訂
- 2026-09-24 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-24 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
We consider control-affine optimal control problems on the torus, where the dynamics and cost functions are only accessed through samples. Starting from a weak formulation of such problems, we derive a dual, a primal, and a primal-dual formulation, compatible with stochastic optimization. We show convergence of stochastic first-order methods to the optimal value under generic conditions. In addition, we introduce a computable metric that upper-bounds the performance of suboptimal controllers produced during optimization, under additional regularity assumptions. Preliminary results show that the method can efficiently solve a simple control problem. Finally, we discuss conditions for the boundedness of the optimal occupation measure, a key assumption for the primal and primal-dual approaches.
arXiv ID: 2609.29265 / 要約の誤りについて