arXiv論文メモ
新着一覧
cs.SD · 査読状況未確認

正常音との相対差を使った異常音の検出

Relative Mismatch: Local-Reference Calibration of Feature-Space Flows for Anomalous Sound Detection

Anbai Jiang, Xinhu Zheng, Lvxin Xu, Shuwei Zhang, Wenrui Liang, Pingyi Fan, Wei-Qiang Zhang, Cheng Lu and Jia Liu

この論文をやさしく読む

ひとことで言うと

生成モデルの予測ずれを近くの正常音で較正し、異常音を見つける方法。

何に役立つ?

機械の音などを監視する異常音検出で、ドメインの違いによる誤検出を抑える設計の参考になる。

この研究の面白いところ

フローマッチングによる速度の食い違いをそのまま使わず、局所的な正常参照との差として評価する。

どこまで分かった?

報告された最高スコアはDCASE 2020~2025での評価結果。どの現場でも同じ性能になるとは要旨からは分からない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

異常音検出では、正常音の標本に対して暗黙に尤度を推定するk近傍法(KNN)の検出器が長く主流だった。本研究は、生成モデルがその役割をよりよく担えるかを調べる。提案するRelative Mismatchはフローマッチングを用いた生成型の異常音検出の後段モデルで、ガウスノイズを正常性を表す特徴空間へ運ぶ速度場を学習する。推論時には、真の経路速度と予測した経路速度の食い違いを測り、2段階の構成で集約する。ドメインのずれによって生じる食い違いの基準値を抑えるため、各問い合わせを近傍の正常参照の食い違いでさらに較正し、正常な状態を超える逸脱だけを取り出す。DCASE 2020~2025での広範な実験では、最新の比較用後段モデルを上回り、最高スコア71.01を得るとともに、頑健性と学習安定性も示した。さらに、コンパクトで識別に適した特徴空間を整えることが、生成モデルの異常音検出能力を引き出す鍵だと示した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-24(UTC)
最新改訂
2026-09-24 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Anomalous sound detection (ASD) has long been dominated by k-nearest-neighbor (KNN) based detectors, which essentially perform implicit likelihood estimation over normal samples. In this work, we investigate whether generative models can better serve this role. We propose Relative Mismatch, a generative ASD backend powered by flow matching, which learns a velocity field that transports Gaussian noise to a representative feature space of normality. During inference, it measures the mismatch between the oracle and predicted path velocities and aggregates them through a two-level design. To mitigate the inherent mismatch offsets incurred by domain shift, each query is further calibrated with the mismatch of its local normal reference, thereby exposing only its deviation beyond normality. Extensive experiments on DCASE 2020--2025 demonstrate that Relative Mismatch outperforms state-of-the-art backends with the highest score of 71.01, along with strong robustness and training stability. Furthermore, we show that curating a compact and discriminative feature space is the key to unleash the power of generative models for ASD.

著者のコメント

Submitted to ICASSP 2027

arXiv ID: 2609.29746 / 要約の誤りについて