脅威分類に沿ったLLM指示でOSS攻撃事例を分類する
Autonomous OSS Threat Detection via Taxonomy-Aligned LLMs
この論文をやさしく読む
ひとことで言うと
実際のOSS攻撃事例を五つの種類に分類する際、分類ルールをLLMへの指示に明示する方法を調べています。999件の事例を集め、GPT-4を使った分類で97.0%の正解率を報告しています。
何に役立つ?
考えられる用途は、サプライチェーン攻撃の報告を共通の分類体系に整理し、調査や分析を支援することです。公開データとコードは比較研究にも利用できるとされています。
この研究の面白いところ
専用に追加学習したモデルが単純なTF-IDF分類器を下回った一方、分類体系を明示したGPT-4が高い成績を示しています。指示の設計が分類性能に与える影響を重視した比較です。
どこまで分かった?
要旨の定量結果は収集済み事件の分類評価です。未知の攻撃を実運用で発見する性能をそのまま示すものではありません。データ分割や漏洩対策、モデルと指示の効果を切り分ける条件は要旨にないため、プロンプトだけが性能差の原因だという一般的な結論は要旨のみからは検証できません。
v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。
アブストラクトの日本語訳
オープンソースソフトウェア(OSS)のエコシステムでは、タイポスクワッティング、依存関係の混同、Trojan Sourceによる難読化、悪意あるビルド処理の注入、CI/CDパイプラインの汚染など、高度なサプライチェーン攻撃による脅威が増している。既存の検出手法はシグネチャベースのツールやルールベースのシステムに依存し、攻撃の亜種や新しい脅威パターンへの一般化に苦戦している。本論文では、OSSサプライチェーンの脅威を自動で検出・分類するため、脅威分類体系に整合させた大規模言語モデルの枠組みを提案する。 五つの攻撃カテゴリを対象とする構造化されたAV-xxx脅威分類体系を導入し、GitHub Security Advisories、CISAの警告、セキュリティ研究報告を情報源として、2018年から2026年にわたる実際のOSSサプライチェーン事件のうち、確認済みの999件を選定したデータセットを構築する。GPT-4に対して分類体系に沿ったプロンプト設計を行うことで、本枠組みは五つの脅威カテゴリ全体で、多クラス分類正解率97.0%、マクロF1スコア97.0%を達成した。 従来型機械学習の五つのベースライン、ゼロショットのオープンソースLLM一つ、ファインチューニング済みニューラルモデル二つとの比較評価から、意外な結果が得られた。ファインチューニングしたLlama 3.1 8B(70.5%)とSecRoBERTa(77.5%)はいずれも単純なTF-IDF分類器(82.3%)を下回り、分類体系との整合を行わないMistral 7Bは65.7%にとどまった。これらの結果は、高い分類正解率を可能にする決定的な要因が、モデル規模、領域に特化した事前学習、ファインチューニングではなく、分類体系に沿ったプロンプトであることを裏付ける。再現可能なサプライチェーンセキュリティ研究を支援するため、データセットとコードを公開している。
v1の要旨から自動生成。本文の精読・人による確認は未実施。
- 初稿
- 2026-10-01(UTC)
- 最新改訂
- 2026-10-01 · v1
- 査読・掲載
- 査読状況未確認
更新履歴
- v1 2026-10-01 この版を読む
取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。
原文の要旨
Open source software (OSS) ecosystems face growing threats from sophisticated supply chain attacks including typosquatting, dependency confusion, Trojan Source obfuscation, malicious build injection, and CI/CD pipeline poisoning. Existing detection approaches rely on signature-based tools and rule-based systems that struggle to generalize across attack variants and emerging threat patterns. In this paper we propose a taxonomy-aligned large language model framework for automated detection and classification of OSS supply chain threats. We introduce a structured AV-xxx threat taxonomy covering five attack categories and construct a curated dataset of 999 verified real-world OSS supply chain incidents sourced from GitHub Security Advisories, CISA alerts, and security research reports spanning 2018 to 2026. Using taxonomy-aligned prompt engineering with GPT-4, our framework achieves 97.0\% multi-class classification accuracy and 97.0\% macro F1 score across all five threat categories. Comparative evaluation against five traditional machine learning baselines, one zero-shot open source LLM, and two fine-tuned neural models reveals a surprising finding: fine-tuned Llama 3.1 8B (70.5%) and SecRoBERTa (77.5%) both underperform simple TF-IDF classifiers (82.3%), while Mistral 7B without taxonomy alignment achieves only 65.7%. These results confirm that taxonomy-aligned prompting rather than model scale, domain pretraining, or fine-tuning is the critical factor enabling high classification accuracy. Our dataset and code are publicly available to support reproducible supply chain security research.
arXiv ID: 2610.01263 / 要約の誤りについて