arXiv論文メモ
新着一覧
cs.AI · 査読状況未確認

場面ごとに変わる個人の価値観をベイズ推論で言語モデルへ反映

From Static Personal Values to Contextualized Personalization: Bayesian Personalized Value Alignment for LLMs

Hanze Guo, Aixuan Song, Jing Yao, Xiangxu Zhang, Xiaoyuan Yi, Xing Xie, Xiao Zhou

この論文をやさしく読む

ひとことで言うと

個人の価値観を固定的に扱わず、その場面で何を重視するかを推定して言語モデルの回答を調整する方法。

何に役立つ?

異なる場面で利用者の優先事項が変わる個別化機能を設計する際の参考になる。

この研究の面白いところ

個人の価値観を事前分布、場面を踏まえた好みを事後分布として表し、推論時に二つを統合する。

どこまで分かった?

要旨はベンチマークで比較手法を上回ったと述べるが、具体的な得点や利用者調査の結果は示していない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

大規模言語モデル(LLM)が多様な利用者の好みに応えることを期待される中、価値観の個別化は重要になっている。しかし既存手法は、質問が変わっても静的な価値観のプロフィールへ出力を合わせることが多く、価値の各側面の重要度が場面によって大きく変わる点を見落としている。個人の傾向と状況上の制約がともに人の行動を形作るとする Lewin の場の理論に着想を得て、個人の価値観を事前分布、文脈依存の好みを事後分布としてモデル化する。推論時に使うベイズ型の文脈認識個別価値整合手法 BaCVA を提案し、静的な個人の価値観と場面固有の価値の重要度を統合して、個別の事後的な好みを近似する。BaCVA はまず、一般的な規範に沿った回答から文脈上の価値の重要度を推定する。その後、個人の価値観と場面に基づく二つの視点を組み合わせた個別化モジュールで、事後的な好みを推論する。このベイズ的な定式化により、事前の価値観を活用してデータ効率を高めながら、より正確で適応的な個別価値整合を可能にする。ベンチマークでの広範な実験では、強い比較手法を上回ったと報告する。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-24(UTC)
最新改訂
2026-09-24 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Personalized value alignment has become increasingly important as large language models (LLMs) are expected to accommodate diverse user preferences. However, existing methods typically align model outputs with a static value profile across prompts, overlooking that the salience of value dimensions varies substantially across contexts. Inspired by Lewin's Field Theory, which views human behavior as jointly shaped by personal dispositions and situational constraints, we model personal values as priors and context-dependent preferences as posteriors. We propose BaCVA, an inference-time Bayesian Context-aware personalized Value Alignment method that approximates posterior personalized preferences by integrating static personal values with scenario-specific value salience. BaCVA first estimates contextual value salience from generally normative responses, and then employs a dual-view personalization module to infer posterior preferences from complementary personal-value and scenario-driven perspectives. This Bayesian formulation enables more accurate and adaptive personalized value alignment while improving data efficiency via prior values. Extensive experiments on benchmarks demonstrate its superiority over strong baselines.

著者のコメント

29 pages, including references and appendices

arXiv ID: 2609.28942 / 要約の誤りについて