部分文字列数の線形ハッシュによる大きな削除訂正符号
Polynomially larger deletion codes by linear hashing of substring counts
この論文をやさしく読む
ひとことで言うと
符号語から2文字が削除されても元を復元できる二進符号について、必要な冗長性の上界を改善します。長く変わらなかったlog nの先頭係数を4から3へ下げる存在結果です。
何に役立つ?
削除誤りに強い符号に、理論上どれだけ情報を詰め込めるかを理解するために役立ちます。一般のt個の削除でも係数を2tから2t−1へ改善しています。
この研究の面白いところ
部分文字列の出現数をランダム線形ハッシュで分類し、一つのラベル群から符号を取り出します。まだ混同する語を2彩色で分け、奇数サイクルを持つ少数の成分を除く構成です。
どこまで分かった?
最良既知の下界の係数2と、新しい2削除上界の係数3の間にはまだ差があります。要旨は符号の存在を示し、実用的な復号速度や実装性能を報告しているわけではありません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
2個の削除を訂正できる長さnの二値符号が、冗長度3 log₂ n + O(log₂ log₂ n)で存在することを示す。これまでの最良上界は1965年以来変わらず主係数4であり、既知の最良下界の係数は2だった。より一般に、t≥2個の削除を訂正できる符号が、冗長度(2t−1)log₂ n + O_t(log₂ log₂ n)で存在することを示し、係数2tを改善する。 部分文字列数に対するランダム線形ハッシュの一つのラベル類から符号を取り出す。この構成は直接構成よりラベル数をおよそn分の1にする。なお同じラベルを共有する紛らわしい語は、奇閉路を持つ連結成分の語を捨てた後、二色分けによって分離できる。奇閉路があるとその閉路に沿った編集が重なり合うため、捨てる必要のある語は少ない。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-16(UTC)
- 最新改訂
- 2026-09-16 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-16 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
We show that binary codes of length $n$ correcting two deletions exist with redundancy $3\log_2n+O(\log_2\log_2n)$. The previous best upper bound had leading coefficient $4$, unchanged since 1965, while the best known lower bound has coefficient $2$. More generally, codes correcting $t\ge2$ deletions exist with redundancy $(2t-1)\log_2n+O_t(\log_2\log_2n)$, improving the coefficient $2t$. We extract a code from one label class of a random linear hash of substring counts, with about $n$ times fewer labels than a direct construction. Confusable words that still share a label are separated by a two-colouring after discarding the words in components with odd cycles, and these are few because an odd cycle forces the edits along it to overlap.
arXiv ID: 2609.19493 / 要約の誤りについて