arXiv論文メモ
新着一覧
math.OC / cs.LG / stat.ML · 査読状況未確認

一重ループで確率的ミニマックス最適化の計算量を保証

Single-Loop Stochastic Projected Damped Extragradient Methods for Stochastic Nonconvex--(Strongly) Concave Minimax Optimization

Huiling Zhang, Minhao Zhang, Zi Xu

この論文をやさしく読む

ひとことで言うと

一方が小さくし、もう一方が大きくする目的を持つ最適化問題で、入れ子の反復を使わずに、所定の精度の停留点へ到達する計算量を保証する研究です。

何に役立つ?

確率的な勾配しか得られないミニマックス問題で、実装の反復構造を単純に保ちつつ、必要な勾配計算回数を評価する基礎になります。

この研究の面白いところ

ゲーム停留性と最適化停留性という異なる基準を両方扱い、強凹の場合と凹の場合を分けて保証しています。分散低減が計算量を改善する条件と、OSの凹の場合には同じ次数にとどまる点も読み取れます。

どこまで分かった?

保証には不偏性と一様な分散上界が必要で、VR-SPDEにはさらに平均二乗Lipschitz条件があります。示すのは停留点までのオラクル呼出し回数で、大域的最適解や実時間の速さの保証ではありません。既知最良という位置づけも著者の報告です。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

確率的な非凸・(強)凹ミニマックス最適化に対して、一重ループの確率的射影減衰外挿勾配法を開発し、ゲーム停留性(GS)と最適化停留性(OS)の両方について計算量を保証する。提案法は、確率的射影減衰外挿勾配法(SPDE)と、再帰的な分散低減を導入した変種VR-SPDEからなり、どちらも一重ループ構造を維持する。 不偏で、分散が一様に有界な確率的勾配オラクルのもとで、SPDEはεゲーム停留点を求める。必要な確率的一次オラクル(SFO)の呼出し回数は、非凸・強凹の場合にO(κ ε⁻⁴)、非凸・凹の場合にO(ε⁻⁵)であり、κ = L/μである。確率的勾配が平均二乗の意味でLipschitz条件を満たすという追加条件のもとでは、VR-SPDEはこのGS計算量をそれぞれO(κ³ᐟ² ε⁻³)、O(ε⁻⁹ᐟ²)へ改善する。 ε最適化停留点については、SPDEのSFO計算量はこの2つの設定でそれぞれO(κ ε⁻⁴)、O(ε⁻⁶)となり、VR-SPDEではそれぞれO(κ³ᐟ² ε⁻³)、O(ε⁻⁶)となる。これらのOS保証は、一重ループで実装できる構造を保ちながら、多重ループ手法が達成した既知最良の限界に一致する。著者らの知る限り、これらの結果は、それぞれの停留性基準と問題クラスについて、一重ループの確率的一次法の中で既知最良のSFO計算量保証を与える。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-18(UTC)
最新改訂
2026-09-18 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

We develop single-loop stochastic projected damped extragradient methods for stochastic nonconvex--(strongly) concave minimax optimization, with complexity guarantees for both game stationarity (GS) and optimization stationarity (OS). Our approach combines a stochastic projected damped extragradient (SPDE) method with a recursive variance-reduced variant, VR-SPDE, both of which retain a single-loop structure. Under an unbiased stochastic gradient oracle with uniformly bounded variance, SPDE finds an $\varepsilon$-game-stationary point with stochastic first-order oracle (SFO) complexities of $O(\kappa\varepsilon^{-4})$ and $O(\varepsilon^{-5})$ in the nonconvex--strongly concave and nonconvex--concave settings, respectively, where $\kappa=L/\mu$. Under an additional mean-square Lipschitz condition on the stochastic gradients, VR-SPDE improves these GS complexities to $O(\kappa^{3/2}\varepsilon^{-3})$ and $O(\varepsilon^{-9/2})$, respectively. For an $\varepsilon$-optimization-stationary point, SPDE achieves SFO complexities of $O(\kappa\varepsilon^{-4})$ and $O(\varepsilon^{-6})$, while VR-SPDE achieves $O(\kappa^{3/2}\varepsilon^{-3})$ and $O(\varepsilon^{-6})$, in the two settings, respectively. These OS guarantees match the best-known bounds achieved by multi-loop methods while preserving a single-loop implementation. To the best of our knowledge, our results provide the best-known SFO complexity guarantees among single-loop stochastic first-order methods for the respective stationarity criteria and problem classes.

arXiv ID: 2609.21747 / 要約の誤りについて