arXiv論文メモ
新着一覧
cs.CV / cs.AI · 査読状況未確認

低テクスチャ領域を使うAI生成画像の検出法

EIB-Net: Entropy-Guided Information Bottleneck for Generalizable AI-Generated Image Detection

Zhida Zhang, Xinlei Ma, Jie Cao

この論文をやさしく読む

ひとことで言うと

画像の質感が少ない部分に注目する方法で、複数の生成モデルをまたぐAI生成画像の検出性能を調べた。

何に役立つ?

生成元のモデルが変わる環境で、少ない学習データから検出器を作る方法の検討に役立つ。

この研究の面白いところ

画像全体ではなくエントロピーが低い画像片を選び、情報ボトルネックで特徴を学習する。

どこまで分かった?

報告された正解率は指定のベンチマークでの結果であり、あらゆる生成画像を確実に識別できることを示すものではない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

写真のように見えるAI生成画像が増える中、異なる生成モデルにも対応できる頑健な検出法が必要である。従来の方法の一部は画像の改変で生じる局所的な痕跡を狙うが、拡散モデルなどで新たに生成された画像にはそのような痕跡がなく、検出が難しい。著者らは、生成モデルが局所的な質感の忠実さより全体の意味を優先する傾向に着目し、質感の少ない領域が生成画像を見分ける手掛かりになると観察した。 そこで、エントロピーに導かれる情報ボトルネック・ネットワークEIB-Netを提案する。新しい画像エントロピー指標を使って情報量の多い、エントロピーの最も低い画像片を自動で選び、変分情報ボトルネックで小さく汎化しやすい特徴を学習する。DIFF、DiffusionForensics、GenImageのベンチマークでの実験では最先端の性能を報告した。訓練データの2%だけで正解率85.7%を達成し、全画像を使う基準手法を15%以上上回った。GenImageでは生成器をまたぐ汎化で平均正解率83.5%を維持した。また、エントロピーに基づく画像片の選択はCNNとTransformerの多様な基盤モデルの性能を一貫して高め、少ないデータでの検出に実用的な価値を示した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-24(UTC)
最新改訂
2026-09-24 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

The proliferation of photorealistic AI-generated images demands robust detection methods that generalize across diverse generative models. While existing approaches target manipulation-based forgeries with local artifacts, generation-based images (e.g., from diffusion models) lack such traces, posing a fundamental challenge. We observe that generative models prioritize global semantics at the expense of local texture fidelity, making low-texture regions key indicators of synthetic origin. To exploit this, we propose EIB-Net, an Entropy-guided Information Bottleneck Network. EIB-Net introduces a novel Image Entropy (IE) metric to automatically select the most informative (lowest-entropy) patch, then processes it with a Variational Information Bottleneck (VIB) to learn compact, generalizable features. Extensive experiments on DIFF, DiffusionForensics, and GenImage benchmarks demonstrate state-of-the-art performance: EIB-Net achieves 85.7\% accuracy using only 2\% of training data, outperforming full-image baselines by over 15\%, and maintains robust cross-generator generalization (83.5\% average accuracy on GenImage). Furthermore, our entropy-guided patch selection (EGPL) consistently enhances diverse backbones (CNNs and Transformers), proving its practical value for data-efficient detection.

著者のコメント

Accept by ICME 2026

arXiv ID: 2609.29064 / 要約の誤りについて