arXiv論文メモ
新着一覧
cs.IT / math.IT · 査読状況未確認

有限長の削除通信路でラン数分布を最適化

Orbit Reduction and Learned Run Distributions for Finite-Blocklength Binary Deletion Channels

Hassan Khodaiemehr and Chen Feng

この論文をやさしく読む

ひとことで言うと

一定の長さのビット列からビットが消える通信で、どのような入力の確率分布が情報を多く伝えられるかを調べています。

何に役立つ?

有限長の削除通信路の性能を評価し、厳密に保証できるレートと近似的な数値評価を区別するために役立ちます。

この研究の面白いところ

対称性で最適化の変数を減らし、小さい入力長の厳密解から大きな入力長へ分布の形を転移させます。学習用の目的関数と、最終的な保証のための厳密評価を分けています。

どこまで分かった?

ORDが全容量と一致するのはN ≤ 3で、保証付き重みの回収はN ≤ 8です。大きいNの入れ子型モンテカルロ結果は容量下界ではありません。d = 0.1では転移の利得がN約128~192で消えるという条件依存性も示しています。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

固定長の入力を使う二元削除通信路で重要な指標は、無限ブロック長の極限C(d)だけでなく、有限ブロック長の容量Cₙ(d) = maxₚ₍ₓᴺ₎ I(Xᴺ;Y)である。本研究では、補数と置換同値の軌道上で一定となる最適入力を選べることを示し、最適化を軌道ごとの一つの重みに縮約する。また、Nパラメータのラン数モデルである最適化ラン分布(ORD)を導入する。ORDはN ≤ 3ではCₙ(d)と一致し、同じラン数で一定の確率を持つすべての入力の中で最適である。厳密な埋込み数計数の動的計画法で、こうした構造を持つ分布の相互情報量Iを評価する。 ニューラル手法と厳密計算を組み合わせた手続きによって、N ≤ 8で保証付きのORD重みを得る。変分的な評価器であるInfoNCE、NWJ、DV/MINE、SMILEは、内部の探索目的としてのみ使う。ORD重みをスコア関数によって直接学習すると、N ≥ 32では平坦なラン長分布(RLD)へと崩れてしまう。そこでORD連続体転移を導入する。小さいNの厳密なORD解から学習した、規格化されたラン数プロファイルを、最大N = 512の対象長で再サンプリングする。転移したORDは、中程度の削除確率で一貫してRLDを上回る。d = 0.1では、その利得はおよそN = 128~192までに消失する。 厳密なORDのレートをFertonani–Dumanの長さエントロピー不等式で変換すると、C(d)の有効な下界となる。大きいNの入力に対する入れ子型モンテカルロ評価は診断として報告しており、容量の下界とは主張しない。N = 100に固定してサンプル数を変える研究により、入れ子型モンテカルロのバイアスを定量化する。主要な報告レートはすべてI(Xᴺ;Y)/Nの値である。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-21(UTC)
最新改訂
2026-09-21 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

For a binary deletion channel operating on fixed-length inputs, the relevant figure of merit is the finite-blocklength capacity $C_N(d)=\max_{p(x^N)}\mathrm{I}(X^N;Y)$, not only the infinite-blocklength limit $C(d)$. We show that an optimal input may be chosen constant on complement and permutation-equivalence orbits, reducing the optimization to one weight per orbit, and introduce the optimized run distribution (ORD), an $N$-parameter run-count model that coincides with $C_N(d)$ for $N\le 3$ and is optimal among all run-count-constant inputs. An exact embedding-count dynamic program evaluates $\mathrm{I}$ for these structured laws. A hybrid neural--exact procedure recovers certified ORD weights for $N\le 8$; variational critics (InfoNCE, NWJ, DV/MINE, SMILE) are used only as inner search objectives. Direct score-function learning of ORD weights collapses toward a flat run-length distribution (RLD) for $N\ge 32$. We therefore introduce ORD continuum transfer: a normalized run-count profile learned from exact small-$N$ ORD solutions is resampled at target lengths up to $N=512$. Transferred ORD consistently outperforms RLD at moderate deletion probabilities; at $d=0.1$ the gain vanishes by roughly $N=128$--$192$. Exact ORD rates converted by Fertonani--Duman's length-entropy inequality are valid lower bounds on $C(d)$; nested-Monte-Carlo evaluations of large-$N$ inputs are reported as diagnostics and are not claimed as capacity lower bounds. A fixed-$N=100$ sample-budget study quantifies nested-MC bias. All primary reported rates are values of $\mathrm{I}(X^N;Y)/N$.

著者のコメント

15 pages, 16 figures, a preliminary conference version of parts of this work was presented at CWIT 2024 conference

arXiv ID: 2609.24889 / 要約の誤りについて