脳の微小状態を単位に長時間の脳波を学習
Brain-Token Learning: Microstate-Based Tokenization and Multi-Scale Interaction for Long-Horizon EEG Sequence Modeling
この論文をやさしく読む
ひとことで言うと
脳波を一定秒数ごとに切る代わりに、繰り返し現れる脳の微小状態を単位に並べて学習する方法です。区切りの長さを脳状態の持続に合わせます。
何に役立つ?
長い脳波記録から状態の変化や全体の文脈を学ぶために役立つ可能性があります。情動・臨床を含む複数のデータセットで表現学習を評価しています。
この研究の面白いところ
生物学的な状態に基づく区切り方と、長い時間幅・短い時間幅の相互作用を組み合わせています。信号の分割方法そのものを見直す研究です。
どこまで分かった?
5データセットで既存法を上回るという報告ですが、要旨には具体的な精度、対象者数、検証分割がありません。臨床EEGを含むことから、診断や治療効果まで実証済みとはいえません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
脳波(EEG)は動的な脳活動を非侵襲的に観察する手段だが、時間的な複雑さが高く、被験者間の変動も大きく、生物学的に意味のある系列表現が欠けているため、長時間のEEG系列のモデリングは依然として難しい。固定長の時間窓やパッチに基づく既存のトークン化は、人為的な時間境界に従ってEEG信号を離散化し、本来の脳状態の動力学を分断するおそれがある。 本研究は、長時間EEG系列のためにBrain Tokenizationを導入する、神経科学に着想を得た枠組みBrain-Token Learningを提案する。あらかじめ決めた時間区間へ信号を分割する代わりに、繰り返し現れる微小状態に由来する脳トークンの系列としてEEGを表す。各トークンは、持続時間が可変の、準安定な大規模脳状態に対応する。こうした生物学的根拠を持つトークンに基づき、Latent State AggregationとState Transition Modelingからなる多尺度トークン相互作用モジュールをさらに開発し、脳状態の大域的文脈と局所的な微小状態遷移を同時に捉える。 新たに収集した長時間データセットNeuroLongと、情動または臨床EEGの4データセットSEED、DEAP、MDD、NSSIを含む、性質の異なる5つのデータセットでBrain-Tokenを評価する。広範な実験により、さまざまなEEGの状況で、従来のCNN/LSTM、Transformerに基づくモデル、ドメイン適応法を一貫して上回ることを示す。追加解析は、頑健で解釈可能なEEG表現を学習するうえで、微小状態に基づくトークン化と多尺度相互作用が有効であることを確認する。これらの結果は、Brain-Tokenを、長時間EEG系列モデリングのための、生物学的根拠を持つトークン化の枠組みとして確立する。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-21(UTC)
- 最新改訂
- 2026-09-21 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-21 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Electroencephalography (EEG) provides a non-invasive window into dynamic brain activity, yet modeling long-horizon EEG sequences remains challenging due to their high temporal complexity, substantial variability across subjects, and the lack of biologically meaningful sequence representations. Existing tokenization strategies, such as fixed-window and patch-based representations, discretize EEG signals according to artificial temporal boundaries, which may disrupt intrinsic brain-state dynamics. In this work, we propose Brain-Token Learning, a neuroscience-inspired framework that introduces Brain Tokenization for long-horizon EEG sequence modeling. Instead of partitioning EEG signals into predefined temporal segments, Brain Tokenization represents EEG as sequences of recurrent microstate-derived brain tokens, where each token corresponds to a quasi-stable large-scale brain state with variable temporal duration. Based on these biologically grounded tokens, we further develop a multi-scale token interaction module consisting of Latent State Aggregation and State Transition Modeling to jointly capture global brain-state context and local microstate transitions. We evaluate Brain-Token on five heterogeneous EEG datasets, including the newly collected long-horizon NeuroLong dataset and four affective or clinical EEG datasets (SEED, DEAP, MDD, and NSSI). Extensive experiments demonstrate that Brain-Token consistently outperforms conventional CNN/LSTM architectures, Transformer-based models, and domain adaptation methods across diverse EEG scenarios. Further analysis verifies the effectiveness of microstate-based tokenization and multi-scale interaction for learning robust and interpretable EEG representations. These results establish Brain-Token as a biologically grounded tokenization paradigm for long-horizon EEG sequence modeling.
arXiv ID: 2609.24324 / 要約の誤りについて