音声認識の追加学習で省メモリと忘却抑制を両立
CGaLore: Curvature-Guided GaLore for Memory-Efficient Continual Adaptation of ASR Foundation Models
この論文をやさしく読む
ひとことで言うと
音声認識モデルに新しい話し方や課題を覚えさせる際、以前の能力を失いにくくする学習方法です。勾配を小さな空間へ圧縮するときに過去の課題の情報を使います。
何に役立つ?
考えられる用途は、限られたメモリで音声認識モデルを新しい領域へ継続的に適応させることです。省メモリ化だけでは扱えない忘却を同時に検討します。
この研究の面白いところ
過去課題の曲率を使って現在の勾配を整えてから、低ランクの射影先を選びます。モデルのパラメータ自体を低ランクに限定する方法ではありません。
どこまで分かった?
要旨は実験とアブレーションによる改善を述べていますが、忘却率、認識誤り率、メモリ削減量の具体値はありません。以前の能力が完全に保たれるという保証ではありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
自動音声認識モデルは、新しい領域、アクセント、下流課題へ適応させると、破滅的忘却に悩まされる。音声基盤モデルの利用が増えるにつれ、この問題はますます重要になる。適応はメモリ効率が高いだけでなく、事前学習で得た幅広い能力を保つ安全なものであるべきだからである。最近提案された勾配低ランク射影(GaLore)は、モデルパラメータをフルランクに保ちながら、勾配の低ランク射影によって最適化器のメモリを削減する、省メモリな微調整手法である。しかしGaLoreは破滅的忘却を考慮しない。 本研究では、低ランク射影基底の選択時に過去課題の曲率情報を取り入れる、曲率誘導GaLore(CGaLore)を提案する。具体的には、勾配部分空間を計算する前に、過去課題から得たクロネッカー因子分解による近似曲率を用いて、現在の課題の勾配をフィルタリングする。実験から、CGaLoreは忘却を緩和しながら効果的な適応を可能にし、最先端の継続学習基準手法を上回ることを示す。広範なアブレーション研究により、CGaLoreの実用的な適用可能性を確認する。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-18(UTC)
- 最新改訂
- 2026-09-18 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-18 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Automatic speech recognition models suffer from catastrophic forgetting when adapted to new domains, accents, or downstream tasks. This problem becomes increasingly important with the growing use of speech foundation models, where adaptation should be both memory-efficient and safe, preserving the broad capabilities learned during pretraining. Gradient Low-Rank Projection (GaLore) has recently been proposed as a memory-efficient fine-tuning method that keeps model parameters full-rank while reducing the optimizer memory through low-rank gradient projection. However, GaLore does not account for catastrophic forgetting. We propose Curvature-Guided GaLore (CGaLore), which incorporates old-task curvature information when selecting the low-rank projection bases. Specifically, CGaLore filters current-task gradients using Kronecker-factored approximate curvature from previous tasks before computing the gradient subspace. Our experiments show that CGaLore enables effective adaptation while alleviating forgetting, outperforming state-of-the-art continual learning baselines. Extensive ablation studies confirm the practical applicability of CGaLore.
著者のコメント
Accepted at SLT 2026
arXiv ID: 2609.21336 / 要約の誤りについて