arXiv論文メモ
新着一覧
cs.LG · 査読状況未確認

画像の見た目が異なる参加者間の連合学習を改善する方法

Joint Domain-Class Modeling for Federated Learning Under Feature Skew

Sina Najafi, Mostafa Tavassolipour, Seyed Pooya Shariatpanahi

この論文をやさしく読む

ひとことで言うと

参加者ごとに画像の見た目が違う連合学習で、その違いを推定して分類器に組み込む手法である。

何に役立つ?

生データを共有せず、参加者間で撮影条件や見た目が異なる画像分類を学習する方法の検討に役立つ。

この研究の面白いところ

短い局所更新から擬似領域を作り、共通の基盤モデルを保ったまま領域とクラスの組み合わせを出力する。二種類の教師信号がともに精度を改善した。

どこまで分かった?

要旨の実証は領域差のある標準的な画像ベンチマークであり、ほかの種類のデータや実際の分散運用での結果は示されていない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

連合学習では個人データを中央に集めずに共同でモデルを学習できるが、特徴の偏りがあると性能が低下しやすい。ここでは参加者が同じラベルを使っていても、各参加者に固有の潜在的な見た目の要因により、ラベルを与えたときの入力分布pi(x|y)が異なる。Joint Domain-Class Federated Learning(JDFL)は、生データを共有せずに、この潜在的な領域差を利用できるようにする、軽量で最適化手法に依存しない拡張である。まず短い局所更新の信号から擬似領域と呼ぶ領域クラスターを推定する。次に分類器の出力部を拡張し、領域数Mとクラス数Cの積に相当する、領域とクラスの組み合わせごとのスコアを出力する。共通の基盤ネットワークを保ちながら、領域ごとの見た目を表現できる。拡張した出力部の学習には、二つの補完的な教師信号の戦略を導入する。一つは、推定された近い領域同士で証拠を伝えながら各領域の専門化も認める、類似性を考慮したソフトラベルである。もう一つは、各サンプルの目標をランダムに割り当てて組み合わせ出力全体の教師信号を揺らし、低費用な学習時の正則化として働かせる方法である。JDFLはFedAvgやSCAFFOLDなどの標準的な連合学習法に小さな変更で統合できる。領域差のある標準的な画像ベンチマークでは、どちらの教師信号方式も全体のテスト精度を一貫して改善した。要素を除いた評価と感度分析は、改善が単にモデル容量を増したためではなく、提案した教師信号とパラメータ化によることを示した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-19(UTC)
最新改訂
2026-09-19 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Federated learning (FL) enables collaborative model training without centralizing private data, but performance often degrades under feature skew: clients share labels while the conditional input distributions $p_i(x\!\mid\!y)$ vary due to latent, client-specific appearance factors. We propose Joint Domain-Class Federated Learning (JDFL), a lightweight, optimizer-agnostic extension that makes this latent domain variation usable without sharing raw data. JDFL first infers domain clusters called pseudo-domains from brief local update signals. It then expands the classifier head to output $M\times C$, joint (domain-class) logits. This allows the model to represent domain-conditioned appearance while keeping a shared backbone. To train the expanded head we introduce two complementary supervision strategies based on simple intuitions: a similarity-aware soft-labeling that transfers evidence between nearby inferred domains while allowing domain-specific specialization, and a per-sample randomized target assignment that perturbs supervision across the joint outputs and serves as a low-cost training-time regularizer. JDFL integrates with existing standard FL methods (e.g., FedAvg, SCAFFOLD) with minimal changes. Empirically, both supervision modes consistently improve global test accuracy on standard domain-shifted image benchmarks; ablations and sensitivity studies show the gains stem from the proposed supervision and parametrization rather than mere capacity increase.

arXiv ID: 2609.22932 / 要約の誤りについて