映画・ニュース・対話の履歴から共通の好み更新を学ぶ
Action-On-Item Preference Flow: A Shared Event Schema for Predictive and Generative Personalization
この論文をやさしく読む
ひとことで言うと
異なるサービスの利用履歴を共通の形式に直し、好みを更新する仕組みを予測と文章生成の両方で使う研究です。
何に役立つ?
ニュース推薦と個人向け見出し生成などで、履歴処理の学習成果を再利用する用途があります。映画への転用も、固定したコアを使う統制実験で調べています。
この研究の面白いところ
利用者の状態を共有するのではなく、別々の状態を更新するパラメータを共通化します。短期・長期など複数の時間スケールを扱う構成も特徴です。
どこまで分かった?
理論には情報源間の明示的な互換性条件があります。15.23ポイントは同構造のランダムコアとの比較であり、あらゆる映画推薦手法に対する優位を示す数字ではありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
利用者の映画、ニュース、対話の履歴は、それぞれ固有の行動や出力が異なるが、どの相互作用も利用者の記憶を更新する証拠になる。本研究は、これらの履歴から、再利用可能な一つの更新機構を学習できるかを検討する。項目に対する行動を表すスキーマは、共通の形へ対応付けた相互作用の役割と内容埋め込みを組にすることで、別々の利用者状態に共通の更新パラメータを適用できるようにする。元のラベルの付け替えに対する不変性、項目埋め込みの摂動に対する状態変化の有界性、明示的な互換性条件の下での統合学習の誤差限界を確立する。 複数時間スケール状態仮説(MTSH)は、この証拠がどのように入力され、保持され、利用されるかを規定する。PerTIDEは、行動ゲーティング、3つの状態空間トレース、それらの融合、指令を条件とする読み出しによってこれを実装する。PENSでは、同じ履歴エンコーダーが次のニュースの予測と個人向け見出しの生成の両方を支える。PENSからMovieLensへの統制実験では、同じ転用先の利用モジュールを学習した後、転用元で学習して固定したコアが、同じ構造のランダムなコアをMRRで15.23ポイント上回る。MINDでは、PerTIDEは同じ入力を使う3分岐の状態空間対照モデルに対してMRRで4.12ポイントの優位を保つ。行動、読み出し、トレースへの介入により、これらの改善への相補的な寄与を特定する。理論と実験を合わせると、互換性のある情報源をまたいで履歴更新を学習し、予測用と生成用の利用モジュールを通じて再利用することが支持される。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-10-01(UTC)
- 最新改訂
- 2026-10-01 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-10-01 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
A user's movie, news, and dialogue histories differ in their native actions and outputs, yet each interaction supplies evidence that can update user memory. We study whether these histories can train one reusable update mechanism. An action-on-item schema pairs a mapped interaction role with a content embedding, allowing shared update parameters to operate on separate user states. We establish invariance to native relabeling, bounded state changes under item-embedding perturbations, and a pooled-training bound under explicit compatibility conditions. The Multi-Timescale State Hypothesis (MTSH) specifies how this evidence enters, persists, and is consumed; PerTIDE implements it with action gating, three state-space traces, fusion, and command-conditioned readout. On PENS, the same history encoder supports both next-news prediction and personalized headline generation. In a controlled PENS-to-MovieLens experiment, a frozen source-trained core exceeds an identically structured random core by 15.23 MRR points after fitting the same target consumer. On MIND, PerTIDE retains a 4.12-point MRR advantage over a same-input three-branch state-space control. Action, readout, and trace interventions identify complementary contributions to these gains. Together, the theory and experiments support learning history updates across compatible sources and reusing them through predictive and generative consumers.
著者のコメント
Accepted to NeurIPS 2026. Author-prepared archival version with expanded discussion and interpretation
arXiv ID: 2610.01375 / 要約の誤りについて