arXiv論文メモ
新着一覧
cs.GT · 査読状況未確認

短時間の操作判断と長期計画を分けたStarCraft II操作

JEV-Star: Fast, Low-Cost StarCraft II Control with Language-Model Planning

Weiyu Ma, Liangbing Zhao, Yongcheng Zeng, Jian Zhao

この論文をやさしく読む

ひとことで言うと

ゲームの素早い操作と長期計画を別のモデルに担当させ、StarCraft IIの内蔵AIと対戦した研究です。

何に役立つ?

ゲームや類似の操作課題で、安価な即時判断と時間をかける計画の分担を考える参考になる。

この研究の面白いところ

応答0.422秒の高速操作を保ちつつ、長期計画を併用してレベル7の内蔵AIに異なる乱数種で勝った。

どこまで分かった?

完全試合は勝利4件で、比較時に操作画面も改善されたため、長期計画だけの寄与は切り分けられていない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

著者らは、高速なJEVによる行動選択と、GPT-6による持続的な計画を組み合わせ、チートをしない内蔵AIの最強レベル7に勝つStarCraft II制御器JEV-Starを提示する。組み合わせたシステムは、レベル5から7までの完全な対局4件に勝ち、そのうちレベル7での勝利は異なる乱数種による2件だった。JEVの応答時間の中央値は0.422秒に保たれた。これらの対局での推定モデル費用は1試合当たり平均3.71米ドルで、内訳はJEVが0.15ドル、GPT-6が3.56ドルだった。最初のJEV単独の制御器と、試合全体の大局的な操作および複数部隊の細かな操作で比較した。単独制御器はレベル2との試合で、拡張せずに20分の制限へ達した。35の戦闘マップで、各マップと制御器につき3試行した比較では、組み合わせたシステムは敵の平均撃破率を16.50%から37.69%へ、105試行中の勝利数を3から7へ高めた。再生画像と判断記録は、成功した完全試合における資源の確保、持続的な経済目標、安定した軍の目標を示す。結果は、安価で1秒未満の判断と、より長い時間範囲の計画を分担する実用的な構成を示した。ただし、比較したのはシステム全体であり、操作画面側の改良も同時に行われたため、計画そのものの寄与は制御した要素除去実験では切り分けられていない。コードは公開されている。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-23(UTC)
最新改訂
2026-09-23 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

We present JEV-Star, a StarCraft II controller that defeats the strongest non-cheating built-in AI, Lv7, by combining fast JEV action selection with persistent GPT-6 planning. The combined system wins four full games at Lv5--Lv7, including two Lv7 victories with different seeds, while retaining a median JEV response time of 0.422 seconds. Mean estimated model cost across these games is USD~3.71 per game: USD~0.15 for JEV and USD~3.56 for GPT-6. We compare this system with an initial JEV-only controller in full-game macro control and multi-unit micromanagement. The standalone controller reaches a 20-minute limit against Lv2 without expanding. Across 35 battle maps with three episodes per map and controller, the combined system raises mean enemy elimination from 16.50\% to 37.69\% and wins from 3 to 7 out of 105. Replay frames and decision logs document resource reservation, persistent economic goals, and stable army objectives in successful full games. The results demonstrate a practical division between inexpensive, subsecond decisions and longer-horizon planning. The comparison evaluates complete systems; concurrent interface improvements mean that planning's contribution is not isolated by a controlled ablation. Code is available at https://github.com/sc2musa/Jev_Star

arXiv ID: 2609.27331 / 要約の誤りについて