arXiv論文メモ
新着一覧
stat.ME · 査読状況未確認

次に調べる仮説を選んで多重検定の標本数を節約

Sample-Efficient Multiple Testing with Adaptive Data Collection

Zhanran Lin, Wanteng Ma, Zhimei Ren, Yuting Wei

この論文をやさしく読む

ひとことで言うと

複数の仮説を同時に調べるとき、有望な仮説に標本取得を振り分けながら、誤った発見の割合を管理する方法です。

何に役立つ?

考えられる用途は、評価や実験に費用がかかり、すべての仮説を同じ回数調べられない場面です。予算内で多くの真の差を見つけるための標本配分を扱います。

この研究の面白いところ

標本を集める相手を途中で変え、停止時点も選べる設定で偽発見率を扱います。一度棄却した仮説を保つ入れ子状の集合も構成します。

どこまで分かった?

保証は条件付きで妥当なe値の増分などの前提に基づきます。偽発見率の制御は、個々の結論に誤りがないという保証ではありません。要旨には実験での具体的な検出率や節約標本数は記載されていません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

本論文は、実験者がどの仮説から標本を得るかを逐次選択する、多重検定の適応的実験計画を研究する。e値に基づく事後サンプリング手順(e-PS)を提案する。この手順は、対数e値の増分の経験平均によってランダム化された標本取得を誘導し、e-BHを適用して棄却集合を構成する。e値の増分が条件付きで妥当であるという条件の下で、任意の停止時点において偽発見率を制御し、入れ子状の棄却集合を生成する。基礎となるe過程の成長と集中の性質を用い、帰無仮説が偽であるすべての仮説を発見するのに必要な標本数について、高確率の上界を示す。この評価を、単純仮説対単純仮説、複合仮説対単純仮説、単純仮説対複合仮説の検定に具体化する。シミュレーションに加え、ジョークの評価と透かし入りテキストを使った実験によって、標本取得予算が限られた状況での検出力を示す。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-22(UTC)
最新改訂
2026-09-22 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

This paper studies adaptive experimental design for multiple testing, where an experimenter sequentially chooses which hypothesis to sample. We propose the e-value-based posterior sampling (e-PS) procedure, which uses the empirical average of log e-value increments to guide randomized sampling and applies e-BH to construct rejection sets. Under conditionally valid e-value increments, the procedure controls the false discovery rate at arbitrary stopping times and produces nested rejection sets. We establish high-probability bounds on the number of samples needed to discover all nonnull hypotheses in terms of the growth and concentration of the underlying e-processes. We specialize these bounds to simple-versus-simple, composite-versus-simple, and simple-versus-composite testing. Simulations and experiments using joke ratings and watermarked text illustrate the procedure's power under limited sampling budgets.

arXiv ID: 2609.26651 / 要約の誤りについて