arXiv論文メモ
新着一覧
cs.AI · 査読状況未確認

水道網の異常を約1秒で一次判定しLLMの確認負担を減らす

HydroJEV: A one-second, training-free screen for cyber-attack and fault attribution in water distribution networks

Tianwei Mu, Shengyan Jiang, Mingzhe Yuan, Qing Luo, Min Xiao, Wenhong Wang, Jun Li, Manhong Huang

この論文をやさしく読む

ひとことで言うと

水道網の警報を、攻撃・物理故障・正常な変化・センサー故障に素早く分類する方法です。約1秒のモデルとルール木がともに問題なしと判断した場合だけ、LLMの再確認を省きます。

何に役立つ?

想定用途は、SCADA警報の原因調査で、ラベル付き事例が少ない状況でも一次判定を行い、確認負担を減らすことです。評価では確認対象区間を35〜38%減らしています。

この研究の面白いところ

速いモデルの判定をそのまま採用せず、問題なしの判定をルール木でも確認する条件を設けています。評価手順を事前登録し、別ネットワークへ設定を変えず移す検証も行っています。

どこまで分かった?

結果はEPANET上のネットワークに基づくベンチマークであり、実水道施設での運用実証とは記載されていません。非劣性マージンの具体値は要旨にありません。省けたのは再確認対象の区間で、すべての判断を一次モデルに任せた結果ではありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

配水網でSCADAの警報が発生すると、運用者は、それがサイバー攻撃、物理的な故障、正常な過渡現象、センサーの故障のどれを反映しているかを素早く判断しなければならない。教師あり分類器には水道事業者がほとんど持っていないラベル付き事故事例が必要であり、最先端の大規模言語モデル(LLM)は1回の判断に数十秒かかる。本研究では、約1秒でクラス確率を返す、学習を必要としないモデルJevを、この一次切り分けの最初の段階に使えるかを検証した。 EPANETのC-Townネットワークに基づく4クラスの原因分類ベンチマークで、Jevを手書きのルール木、教師あり分類器、七つのクラウドLLMと比較した。事前登録し、評価内容を封印した四つのラウンドで、同一の証拠を与えた。ラベルを使わない事前確率補正だけで、Jevはルール木に匹敵した。分布内のマクロF1はJevが0.62〜0.64、ルール木が0.56〜0.61だった。また、四つのラウンドすべてで、教師あり分類器のラベルに含まれない事象の下位分類に対して0.36〜0.42上回り、各クラスのラベル付き事例が約4件未満の場合には、その分類器を上回った。Jevの判断は最先端LLMより20〜40倍速かった。 Jevによる問題なしの判定のうち、ルール木でも確認されたものだけを受け入れると、新たに封印した評価集合で、マクロF1を損なわずにLLMによる再確認の対象区間を35〜38%減らせた。この条件付きカスケードを変更せずにさらに二つのネットワークへ移すと、四つの評価集合すべてで、再確認を行うモデルに対する非劣性マージン内に収まった。したがって、高速で学習を必要としない一次判定は、慎重な再確認の精度を保ちながら、SCADA異常の切り分けにおける確認負担の約3分の1を担える。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-10-01(UTC)
最新改訂
2026-10-01 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

When a SCADA alarm is raised in a water distribution network, operators must decide quickly whether it reflects a cyberattack, a physical fault, a normal transient or a faulty sensor. Supervised classifiers need labelled incidents that utilities rarely have, and frontier large language models (LLMs) take tens of seconds per decision. We tested whether Jev, a training-free model that returns class probabilities in about one second, can serve as the first tier of this triage. On a four-class cause-attribution benchmark built on the C-Town network in EPANET, Jev was compared with a hand-written rule tree, a supervised classifier and seven cloud LLMs on identical evidence in four sealed, pre-registered rounds. With only a label-free prior correction, Jev matched the rule tree (macro-F1 0.62-0.64 against 0.56-0.61 in distribution) and exceeded the supervised classifier by 0.36-0.42 on event subtypes absent from its labels, in all four rounds, and it outperformed the classifier whenever fewer than about four labelled events per class were available. Jev also decided 20-40 times faster than frontier LLMs. Accepting only benign Jev verdicts confirmed by the rule tree spared an LLM reviewer 35-38% of windows on fresh sealed sets without loss of macro-F1. Transferred unchanged to two further networks, this gated cascade stayed within the non-inferiority margin of its reviewer on all four sets. A fast, training-free screen can therefore take over about a third of the review load in SCADA anomaly triage while preserving the accuracy of deliberate review.

著者のコメント

41 pages, 19 figures

arXiv ID: 2610.02048 / 要約の誤りについて