arXiv論文メモ
新着一覧
cs.AI / cs.CL / cs.LG / cs.MA · 査読状況未確認

複数段階のAIエージェント作業で使うモデルの選択

AgentRouter: Heterogeneous Model Routing for Cost-Optimal Multi-Step Agentic Workflows

Rudrendu Kumar Paul, Sourav Nandy

この論文をやさしく読む

ひとことで言うと

複数段階のAIエージェント作業で、各段階の難しさに応じて使うモデルを選ぶ分類器を提案した研究である。

何に役立つ?

作業全体の品質と推論費用の利害得失を見ながら、各段階に適したモデルを選ぶ仕組みの検討に役立つ。示された削減率は論文の評価条件での結果である。

この研究の面白いところ

50,000件の段階データで学習し、最先端モデルだけを使う場合に比べて費用を72%削減しながら品質を97.3%維持したと報告する。

どこまで分かった?

難しい中間・最先端階層の振り分け精度は76~82%で、最も容易な階層より低い。要旨は実運用環境への一般化を示していない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

企業のエージェント型システムで、作業の各段階をすべて最先端の大規模モデルへ割り当てると、小規模モデルでも同等に扱える下位作業に推論予算の60~80%を費やす。既存の振り分け手法は一回の問い合わせの割り当てを最適化するが、エージェント型の作業に固有の、一つの作業過程の中でも下位作業の複雑さが大きく変わる性質を考慮しない。計画段階には最先端級の推論が必要でも、次の書式整形には70億パラメータのモデルで足りる場合がある。そこで作業過程の各段階でモデルを選ぶことを逐次割り当て問題として定式化し、段階ごとに取得できる五つの特徴量から四段階のモデル階層の一つを選ぶ、軽量な分類器AgentRouterを提案する。これは1,200万パラメータで、A100 GPU上での追加処理時間は段階あたり5ミリ秒未満である。計画、コーディング、調査、データ分析にまたがる50,000件の注釈付き作業段階で学習した結果、すべて最先端モデルを使う基準と比べて費用を72%削減し、品質は基準の97.3%を維持した。最終的なタスク完了率の低下は3%未満だった。段階ごとの振り分け精度は最小複雑度の段階で91%、効率重視の階層で85%、より難しい中間および最先端の階層で76~82%だった。同じベンチマークでRouteLLMとFrugalGPTを段階ごとに適用した場合の費用削減は、それぞれ31%と44%にとどまった。これらは一回の問い合わせを基にした学習信号では、作業過程全体の品質に関わる依存関係を捉えられないためだとする。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-19(UTC)
最新改訂
2026-09-19 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Enterprise agentic systems that route every trajectory step to a frontier model waste 60-80% of their inference budget on subtasks that smaller models handle equally well. Existing routing solutions optimize single-turn query assignment but ignore a property unique to agentic workflows: subtask complexity varies widely within a single trajectory. A planning step may require frontier-class reasoning while a subsequent formatting step needs only a 7B model. We formalize step-level model routing as a sequential assignment problem over agent trajectories and propose AgentRouter, a lightweight classifier (12M parameters, <5ms overhead per step on an A100 GPU) that maps each trajectory step to one of four model tiers using five features extractable at routing time. Trained on 50,000 annotated agent trajectory steps spanning planning, coding, research, and data analysis tasks, AgentRouter achieves 72% cost reduction relative to frontier-only baselines, retaining 97.3% of frontier-only quality (less than 3% degradation in end-to-end task completion); per-step routing accuracy reaches 91% on minimal-complexity steps and 85% on efficient-tier steps, with 76-82% on the harder mid-range and frontier tiers. On the same benchmarks, RouteLLM and FrugalGPT (applied per-step) achieve only 31% and 44% cost reduction respectively, because their single-turn training signal misses trajectory-level quality dependencies.

著者のコメント

Accepted at the AgenticUQ Workshop, ICML 2026. Camera-ready version

arXiv ID: 2609.22951 / 要約の誤りについて