家全体の電力から指定家電の消費を推定する共通モデル
Ask for Any Appliance: A Prompt-Programmable Foundation Model for Non-Intrusive Load Monitoring
この論文をやさしく読む
ひとことで言うと
家全体の電力波形から、文章で指定した家電だけの消費電力を取り出す共通モデル。
何に役立つ?
考えられる用途は、家電ごとの専用モデルを増やさず、監視する機器の種類を広げること。要旨では公開データ群による評価を示す。
この研究の面白いところ
稼働の有無と稼働時の電力を分けて予測し、未知の家電には少数の稼働例を加えて対応する。
どこまで分かった?
性能値は指定データ群と12種類の要求に基づく。60秒のスコア集約は精度改善と引き換えに遅延を伴う。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
非侵入型負荷監視(NILM)は家全体の電力計から個別家電の消費電力を推定するが、家電ごとに専用モデルを作り、出力する家電の種類を固定する方式では、対象を増やす費用が大きい。本論文は、集約電力の測定値、自然言語による説明、任意の稼働例から、指定された家電の電力時系列を推定する、プロンプトで指定可能な単一モデルFM4NILMを提示する。 軽量で標本間隔を考慮するTransformerを、1~60秒間隔の七つの公開データ群から集めた64万5000系列で、マスク部分の再構成により事前学習する。次に、ラベルが一部しかない家庭に対応するため、観測のない部分を損失から除いて家電の要求に合わせる。Bernoulli・対数正規のデコーダーで稼働の検出と、稼働時の電力推定を分ける。 REDD、UK-DALE、REFITで学習から除いた家庭と期間を使う評価では、重みを固定した一つのテキスト指示モデルで12種類の家電・データ群の要求に対応し、イベントF1は0.556、AUPRCは0.625、稼働区間の平均絶対誤差は251.8 Wで、七つの家電別基準モデルの中で最も低かった。時系列でスコアを集約すると、60秒の集約遅延と引き換えにイベントF1は0.582へ上がった。別の、家電カテゴリを保留した評価では、稼働例を10個追加するだけで、パラメーターを更新せずに電子レンジのAUPRCが0.132から0.214へ上昇した。入力への介入を用いる切り分け実験では、家電の指示と集約測定値への依存を調べた。結果は、専用ネットワークを増やさず、指示と例で家電の対象を広げ得ることを示す。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-09-19(UTC)
- 最新改訂
- 2026-09-19 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-09-19 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Non-intrusive load monitoring (NILM) estimates appliance-level consumption from a whole-home meter, but appliance-specific models and fixed output inventories make coverage costly to extend. We present FM4NILM (Foundation Model for NILM), a single prompt-programmable model that estimates a requested appliance's power trajectory from aggregate measurements, a natural-language description, and optional activation exemplars. A lightweight cadence-aware transformer is pretrained by masked reconstruction on 645k sequences from seven public corpora spanning 1-60 s sampling intervals, then aligned with appliance requests using observation-masked losses for partially labeled households. A Bernoulli-lognormal decoder separates activity detection from conditional power estimation. On held-out households and time periods from REDD, UK-DALE, and REFIT, one frozen text-prompted model serves twelve appliance-corpus requests, achieving 0.556 event F1, 0.625 AUPRC, and the lowest active-window MAE (251.8 W) among seven appliance-specific baselines. Streaming score aggregation raises event F1 to 0.582 with a 60 s aggregation delay. In a separate category-held-out evaluation, adding ten activation exemplars raises microwave AUPRC from 0.132 to 0.214 without parameter updates. Input-intervention ablations probe the model's dependence on appliance requests and aggregate measurements. These results demonstrate competitive disaggregation with one shared model and support extending appliance coverage through prompts and examples rather than additional specialist networks.
著者のコメント
Preprint
arXiv ID: 2609.23146 / 要約の誤りについて