arXiv論文メモ
新着一覧
cs.LG · 査読状況未確認

画像モデルを固定したまま複数の時系列を予測する

MUSE: Dependency-Aware Adaptation of a Frozen Vision Backbone for Multivariate Time Series Forecasting

Xinying Cai, Junkai Lu, Yuhan Zhu, Xiaoyun Yu, Xiangfei Qiu, Jilin Hu

この論文をやさしく読む

ひとことで言うと

画像を学習したモデルの本体を更新せず、時系列の周期性や変数同士の関係を扱う仕組みを加えて予測する方法です。

何に役立つ?

複数の観測量が関係し合う時系列予測で、既存の画像モデルを再利用する設計の参考になります。実証されたのは10データセットでの予測性能です。

この研究の面白いところ

変数ごとの表現を保ちながら変数間の関係を扱う部分と、周期に関する関係を扱う部分が別々に予測し、最後に学習して混ぜ合わせます。

どこまで分かった?

要旨は最先端性能と報告していますが、具体的な誤差、比較手法、計算量は示していません。モデル本体が固定であることだけから、学習全体の時間や費用の削減幅は判断できません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

多変量時系列予測は、多くの実世界の応用で不可欠である。近年の大規模視覚モデル(LVM)は、領域をまたぐ視覚的な事前知識を時系列予測へ移す、有望な枠組みを提供している。しかし既存のLVMに基づく手法には、独立した視覚表現空間と変数間の依存関係のモデル化を両立すること、自然画像で事前学習した視覚バックボーンを時系列画像特有の時間的意味に適応させること、という2つの主な課題がある。 これらに対処するため、完全に固定した事前学習済みMAEを基盤とする、依存関係を考慮した適応フレームワークMUSEを提案する。第1に、Variable Context Refinement Module(VCR)は、各変数内で共有される時間情報を集約し、独立した視覚空間を維持しながら変数間の文脈的依存関係をモデル化する。第2に、Temporal-Periodic Refinement Module(TPR)は、エンコーダーの異なる深さで軽量な補正を行い、周期をまたぐ時間的依存関係と周期内の周期的依存関係を明示的にモデル化する。2つのモジュールはそれぞれ独立に予測を生成し、学習可能な予測段階のゲートを通じて統合される。実世界の10データセットでの実験により、MUSEが最先端の性能を達成することを示した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-21(UTC)
最新改訂
2026-09-21 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Multivariate time-series forecasting is essential to many real-world applications. Recent large vision models (LVMs) offer a promising paradigm by transferring cross-domain visual priors to time-series forecasting. However, existing LVM-based methods face two key challenges: balancing independent visual representation spaces with cross-variable dependency modeling, and adapting vision backbones pretrained on natural images to the distinct temporal semantics of time-series images. To address these challenges, we propose MUSE, a dependency-aware adaptation framework built on a fully frozen pretrained MAE. First, the Variable Context Refinement Module (VCR) aggregates shared temporal information within each variable and models cross-variable contextual dependencies while preserving independent visual spaces. Second, the Temporal-Periodic Refinement Module (TPR) performs lightweight refinement at different encoder depths and explicitly models across-period temporal dependencies and within-period periodic dependencies. The two modules independently produce forecasts, which are fused through a learnable prediction-level gate. Experiments on 10 real-world datasets demonstrate that MUSE achieves state-of-the-art performance.

arXiv ID: 2609.24441 / 要約の誤りについて