arXiv論文メモ
新着一覧
cs.AI · 査読状況未確認

差分を使う注意機構でスパイキングモデルの細部認識を改善

Contrastive Attention Mitigates Spectral Bias in Spiking Transformers

Xiaoli Liu, Malu Zhang, Yang Yang

この論文をやさしく読む

ひとことで言うと

スパイクを使って計算するTransformerが細かな変化を失いやすい原因を調べ、差分を強調する注意機構で補う研究です。画像の輪郭などに関係する高周波情報に着目しています。

何に役立つ?

画像分類、領域分割、イベントに基づく追跡で、スパイキングTransformerの認識性能を高めるために役立ちます。要旨は複数課題での性能改善と、元の注意機構より低い複雑度を報告しています。

この研究の面白いところ

性能差の原因を二値出力だけでなく、ニューロンと自己注意の両方が低周波を通しやすい性質として分析しています。大域的なコントラスト抽出と局所的な差分処理を組み合わせて、その偏りを補います。

どこまで分かった?

要旨には精度の改善幅、実測消費電力、対象ハードウェアの詳細が示されていません。低い複雑度と効率の改善は報告されていますが、実機の省電力量まではこの要旨から確認できません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

スパイキングTransformerは、スパイキングニューラルネットワーク(SNN)のエネルギー効率と自己注意の表現力を組み合わせ、高性能でエネルギー効率のよい計算のための有望な構造を作り出す。しかし、通常の人工ニューラルネットワーク(ANN)における対応するモデルとの性能差は残っている。この差を二値活性化に帰してきた従来研究とは異なり、本研究はマルチスケールのスペクトル解析によって、スパイキングニューロンとスパイキング自己注意(SSA)の両方が低域通過フィルタとして働くことを明らかにする。この性質は高周波成分の消失を引き起こす。 この問題に対処するため、生物の視覚系が持つ輪郭検出と差分感知の性質に着想を得た、Spiking Contrastive Attention(SCA)を提案する。SCAは、大域的な対照集約によってコントラストのプロトタイプを抽出し、局所的な差分による洗練を適用することで、高周波情報を効果的に強める。 広範な実験から、SCAは画像分類、意味領域分割、イベントベースの追跡にわたって、スパイキングTransformerの性能を一貫して高める汎用モジュールであることを示す。さらに、複雑度を低く抑え、元のSSAより優れた効率を実現する。これらの結果は、エネルギー効率のよいスパイキングTransformerの基本構成要素としての可能性を示す。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-10-01(UTC)
最新改訂
2026-10-01 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Spiking Transformers merge the energy-efficiency of spiking neural networks (SNNs) with the representational power of self-attention, creating a promising architecture for high-performance, energy-efficient computation. However, a performance gap persists versus its counterparts in artificial neural networks (ANNs). Unlike prior works attributing this to binary activations, we reveal that both spiking neurons and spiking self-attention (SSA) act as low-pass filters through multiscale spectral analysis. This characteristic leads to the dissipation of high-frequency components. To address this issue, we propose the Spiking Contrastive Attention (SCA) paradigm, which draw inspiration from the edge-detection and differential sensing properties of biological visual system. By extracting contrast prototypes via global contrastive aggregation and applying local differential refinement, SCA effectively enhances high-frequency information. Extensive experiments show that SCA is a general module that consistently boosts Spiking Transformers across image classification, semantic segmentation, and event-based tracking. Furthermore, it achieves lower complexity, offering superior efficiency over original SSA. These results establish its potential as a fundamental building block for energy-efficient Spiking Transformers.

著者のコメント

Spiking Neural Networks

arXiv ID: 2610.01403 / 要約の誤りについて