arXiv論文メモ
新着一覧
cs.CV · 査読状況未確認

コードで世界の規則を作り動画モデルで描画する

Code Plans, Diffusion Renders: Open-Ended Generative World Modeling

Zixun Fang, Yawen Shao, Kai Zhu, Jie Xiao, Shihan Chen, Yu Liu, Xueyang Fu, Yang Cao, Wei Zhai, Zheng-Jun Zha

この論文をやさしく読む

ひとことで言うと

世界の規則と動きをコードで定義し、動画生成モデルでその様子を描く世界モデル。

何に役立つ?

長く続く相互作用や複数エージェントの場面を表すシミュレーション方式の検討に役立つ。

この研究の面白いところ

見た目と動きの規則を分け、コードを実行可能な世界の状態として保持する。

どこまで分かった?

要旨は複数評価での最先端性能を主張するが、具体的な指標や比較数値は示していない。コードと重みは公開予定という記載である。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

世界モデルの新しい方式CoDeRを提案する。従来の動画による世界モデルが視覚的な観測から世界の動きを暗黙に表すのに対し、このシステムはコードで実行可能な世界を明示的に構築し、動画生成モデルでその見た目を実現する。具体的には、互いを補う五つの役割を調整し、高水準の概念を構造化した世界の規則、実行可能な動力学、知覚される観測へ変換する。この設計により、長期記憶、終わりの決まらない相互作用、自律的な世界の変化、複数エージェントの場面を扱い、複数の存在が現在の観測を超えて継続的に行動、相互作用、変化できる。広範な実験では、既存の世界モデルの能力を大きく広げ、これらの長期記憶、開放的な相互作用、自律進化、継続的な複数エージェントの動態を可能にし、複数の評価設定で最先端の性能を達成した。コードとモデルの重みは公開予定である。プロジェクトページも示されている。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-22(UTC)
最新改訂
2026-09-22 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

We introduce \textbf{CoDeR}, a new paradigm for world modeling. Unlike existing video world models that implicitly represent world dynamics through visual observations, our system explicitly constructs an executable world with code and employs video generation models for visual realization. Specifically, we coordinate five complementary roles to translate high-level concepts into structured world rules, executable dynamics, and perceptual observations. This design enables \textit{long-term memory}, \textit{open-ended interactions}, \textit{autonomous world evolution}, and \textit{multi-agent scenarios}, where multiple entities can act, interact, and evolve persistently beyond the current observation. Extensive experiments demonstrate that our framework substantially extends the capabilities of existing world models, enabling long-term memory, open-ended interactions, autonomous evolution, and persistent multi-agent dynamics, while achieving state-of-the-art performance across multiple evaluation settings. Code and model weights will be made publicly available. Project Page: \href{https://becauseimbatman0.github.io/CoDeR}{CoDeR}.

著者のコメント

https://becauseimbatman0.github.io/CoDeR

arXiv ID: 2609.26458 / 要約の誤りについて