arXiv論文メモ
新着一覧
cs.LG / cs.CR · 査読状況未確認

新しい決済詐欺を反省処理で検出するSR-Fraud

SR-Fraud: An Outcome-Supervised Reflective LLM Agent Framework for Non-Stationary Payment Fraud Detection

Xuwei Tan, Yao Ma, Xueru Zhang

この論文をやさしく読む

ひとことで言うと

確定した誤りを後から振り返り、根拠のある判断ルールだけを取り込む決済詐欺検出手法。

何に役立つ?

新しい詐欺パターンが現れる環境で、定期的な再学習までの変化を捉える方法を検討する材料になる。

この研究の面白いところ

取引時の固定エージェントと、オフラインで仮説を検証するエージェントを分けている。

どこまで分かった?

要旨は実運用データの評価基準での点推定値を報告するが、差の具体的な数値や統計的な不確実性は示していない。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

リアルタイムの決済詐欺検出は、時間とともに性質が変わる連続的な予測問題である。監督学習に使えるラベルが確定する前に攻撃者が適応し、局所的な急増攻撃は再学習前に損失を生み得る。運用システムは通常、表形式データの分類器と規則に頼るが、定期的な再学習前に現れる新しい時系列パターンを捉えにくいことがある。本研究は、リクエスト時の判断とオフラインでの適応を分ける、結果を教師信号とする振り返り型言語モデル枠組みSR-Fraudを提示する。重みを固定し、状態を持たないエージェントが、行動の変化を追うHybrid Episodic Windowから各取引を採点する。一方、オフラインの振り返りエージェントは、結果が確定した誤りから判断境界についての仮説を提案する。その後、決定的な検証器が根拠のある仮説だけを実行可能な知識状態へ取り込む。実運用の決済詐欺評価基準では、SR-Fraudは固定された判断エージェントより全検出指標を改善し、静的なCatBoostおよび定期的に再学習したCatBoostより高い点推定値を得て、新たな詐欺の急増も検出した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-23(UTC)
最新改訂
2026-09-23 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

Real-time payment fraud detection is a non-stationary streaming prediction problem: adversaries adapt before supervised labels mature, and localized burst attacks can cause losses before retraining. Production systems typically rely on tabular classifiers and rules, which can struggle to capture these emerging sequential patterns before periodic retraining occurs. We present SR-Fraud, an outcome-supervised reflective LLM framework that decouples request-time decisions from offline adaptation. A frozen, stateless agent scores each transaction from a Hybrid Episodic Window to track behavioral shifts, while an offline reflection agent proposes boundary hypotheses from matured errors. A deterministic verifier then admits only supported hypotheses into an executable knowledge state. On a production payment-fraud benchmark, SR-Fraud improves all detection metrics over its frozen decision agent, obtains higher point estimates than static and periodically retrained CatBoost, and detects an emerging fraud burst.

arXiv ID: 2609.27287 / 要約の誤りについて