株価予測因子の探索経路を広げるローカルAIエージェント
AlphaDiverse: Post-Training Local Quantitative Research Agents for Diverse Exploration in Alpha Factor Mining
この論文をやさしく読む
ひとことで言うと
株式の予測因子を探すAIエージェントが同じ発想を繰り返さないよう、探索履歴を集めて学習させます。
何に役立つ?
アルファ因子探索の経路を多様にし、外部APIに依存しないローカルエージェントを作る際の参考になります。
この研究の面白いところ
計画の組と研究環境を変えて多様な履歴を作り、予測の質と貢献の多様性を同時に最適化します。
どこまで分かった?
中国株の4銘柄群での実験結果です。要旨に具体的な予測指標や実運用収益は記載されていません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
大規模言語モデル(LLM)による複数エージェントのシステムはアルファ因子の探索を自動化できるが、外部APIへの依存は費用、利用可能性、機密性の管理を制限する。また、長い研究の反復では少数の成功した経済的な仕組みを繰り返し探し、探索経路が狭まりやすい。これらに対処するため、複数エージェントによるアルファ研究システム、多様な研究経路の収集、ローカルエージェントの事後学習を統合するAlphaDiverseを提案する。研究システムに相補的な計画の組を作らせ、反復ごとに研究環境を変えて、多様な経路を集める。 この多様な履歴を使い、ローカルのPlannerとRealizerというエージェントを教師ありの微調整で初期化する。次に、予測の質と貢献の多様性を用いて両者を最適化する共同GRPO法を提案する。研究へのフィードバックは内側の期間のデータだけに限定し、最終モデルを固定して後の外側の期間のデータで評価することで、テストデータへの調整を避ける。中国株の4つの銘柄群にわたる実験では、AlphaDiverseが競争力のある予測と、より広い探索を両立できることを示した。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-24(UTC)
- 最新改訂
- 2026-09-24 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-24 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Large language model (LLM)-based multi-agent systems can automate alpha factor mining, but their reliance on external APIs limits control over cost, availability, and confidentiality. Long research loops also tend to revisit a few successful economic mechanisms that lead to research path collapse. To address these limitations, we propose AlphaDiverse, a framework that integrates a multi-agent alpha research system, diverse research path collection, and post-training for local agents. We let the research system generate complementary plan portfolios and vary research environments across loops to collect diverse research paths. Using these diverse traces, we warm-start local Planner and Realizer agents with supervised fine-tuning. Then, we propose a joint GRPO method to optimize both of them using predictive quality and diversity of contributions. Research feedback is confined to inner period data, while a frozen final model is evaluated on a later outer period data, thereby avoiding test-set tuning. Experiments across four Chinese stock universes show that AlphaDiverse can combine competitive prediction with broader exploration.
著者のコメント
33 pages, 7 figures, 26 Tables. Preprint under review
arXiv ID: 2609.29014 / 要約の誤りについて