arXiv論文メモ
新着一覧
cs.CR / cs.AI · 査読状況未確認

再コンパイルの一致を手掛かりに逆コンパイルを改善するEcho

Echo: Learning-based Matching Decompilation using Trusted Back Translation

Jun Bi, Xiangxin Fang, Aarsh Chaube, José Wesley De Souza Magalhães, Rodrigo C. O. Rocha, Michael O'Boyle

この論文をやさしく読む

ひとことで言うと

バイナリから推測したコードを実際に再コンパイルし、元のアセンブリとのずれを使ってコードとコンパイル設定を修正する逆コンパイル手法です。

何に役立つ?

ソフトウェア解析で、読みやすいだけでなく元の機械語と一致するコードを復元するための方法になります。

この研究の面白いところ

コンパイラを最後の合否判定に使うだけでなく、探索途中のフィードバックにも使います。コードとコンパイル設定を組として探す点も特徴です。

どこまで分かった?

倍率は対象ベンチマークで完全一致した関数数の比較です。全プログラムの復元率や元のソースを一意に復元したことを意味しません。要旨には一致数の絶対値や全コンパイル条件は示されていません。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

ニューラル逆コンパイラは、バイナリから読みやすく再コンパイル可能なソースコードを復元できるが、その予測はなお信頼性を判断しにくい。一致型逆コンパイルは、再コンパイルしたアセンブリが対象と完全に一致するソースコードを探索することで、この問題に対処し、正しさのより強い証拠を与える。しかし、コンパイル設定が不明な最適化済みバイナリでの完全一致は依然として難しい。 信頼できる逆方向変換に基づく一致型逆コンパイルシステムEchoを提案する。重要な着想は、コンパイルを検証だけでなく、反復探索を導く信頼できるフィードバックとして使うことである。Echoはまず領域特化モデルを使い、プログラムとコンパイル設定の候補を生成する。候補を再コンパイルし、アセンブリレベルの類似度を測り、有望なコードと設定の組を合成する。残る不一致を、規則に基づく書換え、ニューラルな改良、推論に基づく改良により、段階的に修復する。 関数単位のベンチマークとMiraiマルウェアのバイナリでEchoを評価する。最も強い比較手法に対し、Echoは平均で2.43倍の完全一致を生成し、正解ソースコードへの構造的類似度でも最高を達成する。Miraiでは、GPT-5.6の2.75倍、Codexの7.4倍の関数を一致させる。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-16(UTC)
最新改訂
2026-09-16 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Neural decompilers can recover readable and recompilable source code from binaries, but their predictions remain difficult to trust. Matching decompilation addresses this problem by searching for source code whose recompiled assembly exactly matches the target, providing stronger evidence of correctness. However, exact matching remains challenging for optimized binaries under unknown compilation configurations. We present Echo, a matching decompilation system based on trusted back-translation. Our key insight is to use compilation not only for verification, but also as trusted feedback to guide iterative search. Echo first uses a domain-specific model to generate candidate programs and compilation configurations. It recompiles these candidates, measures assembly-level similarity, and synthesizes promising code-configuration pairs. Remaining mismatches are then progressively repaired using rule-based rewriting, neural refinement, and reasoning-based refinement. We evaluate Echo on function-level benchmarks and the Mirai malware binary. Compared with the strongest baseline, Echo produces 2.43x more exact matches on average and achieves the highest structural similarity to ground-truth source code. On Mirai, Echo matches 2.75x and 7.4x as many functions as GPT-5.6 and Codex, respectively.

著者のコメント

19 pages, 8 figures

arXiv ID: 2609.18706 / 要約の誤りについて