arXiv論文メモ
新着一覧
cs.SD / cs.LG · 査読状況未確認

実環境を意識した小型の水中船舶音分類

Towards Deployable Underwater Vessel Classification

Abishek Soti, Thura Pyae Sone, Naqib Ibnul, Htoo Htet Aung, Henry Zhong, Gregory Cohen, Ying Xu

この論文をやさしく読む

ひとことで言うと

水中の音から船舶を分類する小型モデルを、録音の分け方にも注意して評価した研究です。

何に役立つ?

小型の水中音響システムのモデル設計と、性能評価の方法を考える際に役立ちます。

この研究の面白いところ

一見高いShipsEarでの成績に加え、元録音が重ならないDeepShipで別途評価しています。

どこまで分かった?

ShipsEarでは録音単位の独立性を確認できず、DeepShipのテスト結果はマクロF1=0.7226です。実海域での運用性能は要旨にありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

水中音響の時間周波数表現と蝸牛に着想を得た表現を対象に、複数表現の特徴量作成、時間方向の統計的な集約、小型の畳み込み構造を組み合わせる、コンパクトな水中音分類の枠組みを提案する。従来型と聴覚に着想を得た複数の表現を調べ、まずShipsEarデータセットで軽量分類器と畳み込みニューラルネットワーク(CNN)を評価した。提供された分割では、2層CNNのマクロF1は0.9918、動径基底関数を用いたサポートベクターマシンは0.9883だった。しかし、元録音の出所を復元できないため、録音単位で独立したデータへの汎化は検証できない。そこでDeepShipデータセットでは、音声を細分化する前に元録音ごとにデータを分けて評価した。この手順では、パラメーター数15万7000の小型CNNがテストでマクロF1=0.7226を達成し、1117万パラメーターのResNet18は条件を合わせた検証で性能改善を示さなかった。結果は、コンパクトな水中音響システムの分類性能と実際の利用を考えるうえで、表現に合った特徴量とモデルの設計、さらに元録音単位の厳密な評価が重要であることを示す。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-24(UTC)
最新改訂
2026-09-24 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

We propose a compact underwater acoustic classification framework combining multi-representation feature engineering, temporal statistical pooling, and compact convolutional architectures designed for acoustic time-frequency and cochlear representations. We investigate multiple conventional and auditory-inspired representations and first evaluate lightweight classifiers and Conventional Neural Networks (CNNs) on ShipsEar dataset. On the provided split, a two-layer CNN achieves a macro F1 of 0.9918, while a Radial Basis Function Support Vector Machine (RBF-SVM) reaches 0.9883. However, source-recording provenance cannot be reconstructed, preventing verification of recording-independent generalisation. We therefore evaluate on DeepShip dataset using recording-level partitioning before segmentation. Under this protocol, a 157K-parameter compact CNN achieves a test macro F1 of 0.7226, while an 11.17M-parameter ResNet18 provides no improvement in validation performance under the matched setting. These results demonstrate the importance of representation-aware feature and model design, together with rigorous recording-level evaluation, for classification performance and deployability in compact underwater acoustic systems.

arXiv ID: 2609.29179 / 要約の誤りについて