arXiv論文メモ
新着一覧
cs.AI · 査読状況未確認

AIの計画と実行への情報・計算資源の配分を検証する

The Organization of Inference: Information, Resource Constraints, and AI Production

Yukun Zhang, Kemu Xu, Yishen Chen

この論文をやさしく読む

ひとことで言うと

AIのソフトウェア作業で、計画と実行への計算予算や情報の配り方が成功率にどう効くかを実験します。

何に役立つ?

事前計画を入れる価値を、単純なモデルの大きさだけでなく作業構成から判断する材料です。

この研究の面白いところ

同じ予算でも、計画担当が課題内容を見られるかで結果が変わります。予算を増やすと計画方式の不利が縮む比較と、別の情報付き計画実験を区別して報告します。

どこまで分かった?

複数の実験系列を一つの成功率の比較へまとめることはできません。また提供された要旨の最終文は途中で終わっており、未記載の結論を補ってはいません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

推論の経済的価値は、AIによる生産の各段階に処理能力とタスク情報をどう配分するかによって変わる。本研究では、外部で検証されたソフトウェア工学タスクについて、条件を制御したワークフロー実験を行い、こうした組織設計上の選択を調べる。 条件をそろえた2つの資源別実験群では、論理トークンの上限が12,000でも24,000でも、直接実行の成功率は59.6%で同じだった。一方、情報が制限された計画を介した場合の成功率は36.2%から51.2%に上がった。計画方式の不利は15.0パーセントポイント縮小した。タスクをクラスタとするブートストラップの95%区間は4.2~25.8ポイントだった。 計画段階を厳密に読み取り専用にした一連の実験では、計画担当がタスクの課題記述を見られるかどうかを変えた。12,000トークンでは、課題記述へのアクセスにより、記述を隠した計画に比べて成功率が約16パーセントポイント上がった。直接実行と比べると、タスク情報を与えた計画は12,000トークンでは約10ポイント低いが、24,000トークンでは29.6ポイント高かった。 資源別実験群では、直接実行の使用量はいずれの上限も大きく下回った。一方、計画ワークフローが上限に制約される割合は46.2%から0.8%に下がり、総使用量の増加の89.9%は後段の実行が占めた。規模はシステムが利用できる能力を決め、ワークフローと情報構造はその生産上の価値を形づくる。 訳注:arXivに掲載された要旨も、末尾が「the productive value」で途切れている。ここでは掲載されている範囲をすべて訳し、欠落部分は補っていない。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-17(UTC)
最新改訂
2026-09-17 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

The economic value of inference depends on how capacity and task information are distributed across stages of AI production. We study these organizational margins using controlled workflow experiments on externally verified software-engineering tasks. In two matched resource panels, direct execution records the same success rate of 59.6 percent at logical-token ceilings of 12,000 and 24,000, while success under information-constrained planning rises from 36.2 to 51.2 percent. The planning disadvantage narrows by 15.0 percentage points (95 percent task-cluster bootstrap interval: 4.2 to 25.8). A strict read-only planning campaign varies whether the planner sees the task issue. At 12,000 tokens, issue access raises success by about 16 percentage points over issue-hidden planning. Compared with direct execution, task-informed planning is about 10 points lower at 12,000 tokens; at 24,000 tokens, it shows a 29.6-point advantage. In the resource panels, direct execution uses substantially less than either ceiling, while the planning workflow's binding rate falls from 46.2 to 0.8 percent and downstream execution accounts for 89.9 percent of the increase in total use. Scale determines the capacity available to a system; workflow and information structure shape the productive value

arXiv ID: 2609.20449 / 要約の誤りについて