arXiv論文メモ
新着一覧
cs.CR · 査読状況未確認

乱数の品質低下が差分プライバシーに及ぼす影響

Empirical Analysis of Randomness Quality in Differential Privacy Mechanisms

Cesare Gerolimetto Fabrello, Valeria Rossi, Alberto Trombetta, Massimo Caccia

この論文をやさしく読む

ひとことで言うと

差分プライバシーに使う乱数の質を意図的に落とし、ノイズ分布やプライバシー損失にどう影響するかを実験します。

何に役立つ?

プライバシー保護実装で、乱数源の劣化をどのように点検するか考える材料になります。量子乱数や暗号学的擬似乱数から、制御して劣化させた乱数まで比較します。

この研究の面白いところ

100万回を超える問い合わせを通してプライバシー損失の経験分布を直接調べます。分布の異常を検出したことと、実際にプライバシー保証が破れたことを明確に区別します。

どこまで分かった?

8〜16ビットに約1ビットの操作で検出できるという結果は、用いた実装と実験条件に依存します。ビットの偏りと時間相関でも検出感度が異なります。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

差分プライバシー(DP)は、統計分析で個人のプライバシーを保護するため、慎重に調整したランダムノイズに依存している。乱数性に関する仮定を弱めた場合のDPは理論研究で分析されてきたが、エントロピーの低下が実際にどのような影響を及ぼすかは十分に理解されていない。 本研究では、IBMのDiffPrivLibを用い、乱数の品質が差分プライバシー機構に与える影響を体系的に実証調査する。高品質な量子真性乱数生成器(TRNG)と暗号学的に安全な擬似乱数生成器(PRNG)から始め、エントロピーの低下を制御しながら系統的に操作した乱数源に至るまで、品質を段階的に低下させたエントロピー源を導入し、確立されたテストスイートで特性を評価する。参照データベースに対する100万件のクエリにわたる反復実験と、補完的な統計検定を通じて、プライバシー損失確率変数の経験分布を直接分析する。 その結果、およそ8〜16ビットに1ビットを操作すると、DP機構の逸脱を安定して検出できる一方、ビット単位の偏りと時間的相関とでは検出感度が大きく異なることを示した。また、分布の異常を統計的に検出することが、実際のプライバシー保証違反に必ずしも対応しないことも示す。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-17(UTC)
最新改訂
2026-09-17 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Differential Privacy (DP) relies on carefully calibrated random noise to protect individual privacy in statistical analyses. While theoretical work has analyzed DP under weakened randomness assumptions, the practical consequences of entropy degradation remain poorly understood. We present a systematic empirical investigation of how randomness quality affects differential privacy mechanisms using IBM's DiffPrivLib. We introduce progressively degraded entropy sources characterized by established test suites, starting from high-quality quantum True Random Number Generators (TRNGs) and cryptographically secure Pseudo-Random Number Generators (PRNGs) down to systematically manipulated sources with controlled entropy degradation. Through repeated experiments over one million queries on a reference database and complementary statistical tests, we directly analyze empirical Privacy Loss Random Variable distributions. Our results demonstrate that DP mechanisms reliably detect deviations when approximately 1 bit in every 8 to 16 is manipulated, with detection sensitivity varying significantly between bit-level biases and temporal correlations. We demonstrate that statistical detection of distributional anomalies does not necessarily correspond to actual privacy guarantee violations.

arXiv ID: 2609.20561 / 要約の誤りについて