arXiv論文メモ
新着一覧
cs.DC / cs.AI / cs.PL · 査読状況未確認

LLMで調整した命令複製による並列ソフトのソフトエラー検出

Detecting Soft Errors in Parallel Software with LLM-tuned Instruction Duplication

Yafan Huang, Guanpeng Li

この論文をやさしく読む

ひとことで言うと

一時的な計算誤りを命令の複製で検出する保護を、並列プログラム向けに効率化します。直列部分と並列部分が混在するコードを扱い、実行時の高価なプロファイルに頼らない設計です。

何に役立つ?

マルチスレッドソフトウェアに誤り検出を入れるとき、その速度低下を抑えるために役立ちます。コンパイル時の変換と性能モデルの調整に作業を集中させます。

この研究の面白いところ

オフライン分析から得た8つの知見を使い、LLMで調整した性能モデルと並列性を考慮した変換を組み合わせます。NPBで平均保護オーバーヘッドを162.79%から59.84%へ下げたと報告しています。

どこまで分かった?

評価はNPBベンチマークの範囲です。完全な検出有効性を維持したという記述もその評価条件に基づき、すべての種類の故障を検出する保証ではありません。最大5倍の高速化を平均値と混同しないことも必要です。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

PaRID(Parallel Instruction Duplication)という、マルチスレッド並列プログラムに対してコンパイル時の作業だけで済む、ソフトウェア主導のソフトエラー検出フレームワークを提案する。PaRIDは、直列領域と並列領域が混在する並列プログラムを扱うことと、高価な動的プロファイリングに頼らず性能オーバーヘッドを抑えることという二つの課題に対処する。並列性を考慮したコード変換と、オフライン特性評価で得た一般化可能な八つの知見に基づきLLMで調整した性能モデルを組み合わせ、並列アプリケーションで高速にソフトエラーを検出する。NPBベンチマークでの評価では、保護オーバーヘッドを平均162.79%から59.84%へ削減し、完全なエラー検出効果を維持しながら最大5倍の高速化を達成した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-17(UTC)
最新改訂
2026-09-17 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

We propose PaRID (PaRallel Instruction Duplication), a software-directed soft error detection framework that requires only compile-time effort for multithreading parallel programs. PaRID addresses two key challenges: supporting parallel programs with mixed serial and parallel regions and minimizing performance overhead without relying on costly dynamic profiling. It combines parallel-aware code transformation with LLM-tuned performance modeling, guided by eight generalizable findings from an offline characterization study, to enable fast soft error detection in parallel applications. Evaluation on NPB benchmarks shows that PaRID reduces protection overhead from 162.79% to 59.84% on average and achieves up to 5x speedup while maintaining full error detection effectiveness.

arXiv ID: 2609.19531 / 要約の誤りについて