arXiv論文メモ
新着一覧
cs.AR · 査読状況未確認

反復間の依存を考慮して再構成可能回路の処理速度を高める

CONFERM: Recurrence-Aware Temporal Mapping for Multi-Cycle Multi-Context CGRAs

Jun Yin, Jannes Willemen, Stef Cuyckens, Chao Fang, Marian Verhelst

この論文をやさしく読む

ひとことで言うと

再構成可能な計算回路で、ループの反復同士をよりうまく重ねて実行できるよう、処理の割り当て方を変える手法です。

何に役立つ?

DSPや機械学習の計算をCGRAへ割り当てる際に、実行の処理量とマッピングにかかる時間の両方を改善する用途が考えられます。

この研究の面白いところ

回路に割り当てるグラフを固定せず、支配的な時間制約を見て表現を調整します。反復のずれをそろえることが、制御系列の短周期化にもつながっています。

どこまで分かった?

報告された2.18倍、46%、5.07倍は10種類のカーネルでの比較結果です。要旨には対象回路の規模、各カーネルの内訳、消費電力や実機測定の詳細はありません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

デジタル信号処理(DSP)や機械学習の処理量は、反復をまたぐループ依存と、遅延が長く複数サイクルを要する計算ノードという、2つの時間的構造によって制限されることが多い。時空間型の粗粒度再構成可能アレイ(CGRA)では、複数コンテキストのモジュロ構成にまたがって反復を重ね合わせることで、両方のボトルネックに対処できる。しかし既存のCGRAマッパーは、反復依存を考慮したスケジューリングと演算子単位のパイプライン化を別々に扱う固定のデータフローグラフ(DFG)をスケジュールするため、反復間の重なりが制限され、配線の負担が増える。 これに対し本研究では、反復依存を考慮する時間マッパーCONFERMを提案する。支配的な時間制約を手掛かりにDFGの表現を決め、反復をまたぐパイプライン化の機会を明らかにする。CONFERMはスケジューリング中にボトルネック領域を特定し、優先的に扱う。交互に配置された反復の間で、反復をまたぐオフセットを規則的にすることで、生成される制御系列を元の開始間隔より短い周期で繰り返せる。その結果、CGRAの構成オーバーヘッドを抑えつつ処理量を高められる。 10種類のベンチマーク・カーネルにおいて、CONFERMは最先端のマッパーに対し処理量を2.18倍にする。反復オフセットを一様にすることで、生成される開始間隔は46%短くなる。また、同じヒューリスティックなマッパーのバックエンドを用いた場合、CONFERMのマッピング処理は平均5.07倍速く収束する。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-10-01(UTC)
最新改訂
2026-10-01 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Throughput in DSP and machine learning workloads is often limited by two temporal structures, i.e., loop-carried recurrences and long-latency, multi-cycle compute nodes. On spatio-temporal coarse-grained reconfigurable arrays (CGRAs), both bottlenecks can be addressed by overlapping iterations across the multi-context modulo configurations. Yet, existing CGRA mappers schedule a fixed dataflow graph (DFG) that treats recurrence-aware scheduling and operator-level pipelining separately, limiting inter-iteration overlap and inflating routing pressure. To tackle this, we present CONFERM, a recurrence-aware temporal mapper that uses the dominant temporal con-straint to guide the DFG representation and expose opportunities for loop-carried pipelining. CONFERM identifies and prioritizes bottleneck regions during scheduling. The regular loop-carried offsets across interleaved iterations allow the emitted control sequence to repeat at a shorter cadence than the original initiation interval, thus delivering higher throughput with lower CGRA configuration overhead. Across ten benchmark kernels, CONFERM improves throughput by 2.18x over state-of-the-art mappers. Its uniform iteration offsets shorten the emitted initiation interval by 46%. CONFERM's mapper pass also converges faster by 5.07x on average with the same heuristic mapper backend.

著者のコメント

Accepted by ICCD 2026, 16-18 November 2026, Hong Kong, China

arXiv ID: 2610.01975 / 要約の誤りについて