arXiv論文メモ
新着一覧
cs.AI · 査読状況未確認

GPU上で論理推論とニューラル認識を統合するXLOG

XLOG: A CUDA-Native Engine for Neurosymbolic Integration

Levi Dubrovin, Nikita Pospelov, Kirill Sabitov

この論文をやさしく読む

ひとことで言うと

GPU上で論理プログラムとニューラル認識を組み合わせ、速度と推論の正しさを評価するシステム研究。

何に役立つ?

考えられる用途は、確率的な論理推論やニューラル認識を含む処理のGPU実装。要旨では課題によって速度と精度を比べている。

この研究の面白いところ

回路を元の論理式に対して検証しつつGPU上で勾配を通し、MNIST足し算では回路キャッシュにより学習を2.74倍速くした。

どこまで分かった?

厳密推論はProbLog2より遅く、動画の規則探索は交差検証と漏れのない分割で失敗した。速度の優位性は課題と規模に依存する。

v1のアブストラクトに基づくAI解説。日本語訳とは別に、用途の解釈を含みます。

アブストラクトの日本語訳

xlogはCUDA上で動く論理プログラミングエンジンである。型付きの入力処理と実行環境が管理するCUDAランタイムを介し、ニューラル認識、決定的なDatalog、確率的推論、知識に関する世界観を統合する。推論方式はGPU上のデータ処理基盤を共有するが、実行の境界は異なる。通常のDatalogと厳密推論はホスト側で制御し、GPUに常駐すると認証された再帰処理とMonte Carlo標本抽出の中核部分は、終端の限定された結果通知まで、追跡対象のホスト・GPU間転送をゼロにする。 確率的な経路では、来歴情報からCNF、Decision-DNNFへのGPU上の知識コンパイル、厳密な重み付きモデル計数、逆方向の勾配を通じて全工程で勾配を伝えられる。最後に平滑化した回路は、保存や評価の前に元の論理式に対する正しさを検証する。回路のキャッシュによりMNISTの足し算課題の学習は2.74倍速くなり、最悪時に最適な結合処理の部分系は、xlog自身の二項結合基準より幾何平均で27.96倍速かった。MNISTの足し算の正解率はScallopと同程度で、0.9561対0.9468だった。ただし基準法の一エポックの時間がCPU割当量で変わるため、エポック当たりの速度に関する主張はしていない。 中心ノードに辺が集中した三角形計数の五事例では、Souffléに対する統合版xlogの実行時間比は、Souffléの方が速い15万辺で0.88倍から、120万辺で5.54倍へ上がった。統合版のGPU上の最大メモリ割当量は85~1033 MBで、途中結果を実体化する方式の3287~4万4979 MBに対して小さかった。厳密推論はProbLog2と正しさの上で同等だが、速度は遅かった。公開動画ベンチマークでは、論理的な寄与だけで学習した近接判定が、人手で設定した幾何条件を置き換えても保留データの正解率を保った。しかしEvent Calculusの規則探索では10分割交差検証に失敗し、情報漏れのない分割でも移転しなかった。海事分野のデータでは、重み付きの論理節が二値の選択をF1値で0.065上回り、その結果は時系列に沿った一回の学習でも再現した。

v1の要旨から自動生成。本文の精読・人による確認は未実施。

初稿
2026-09-23(UTC)
最新改訂
2026-09-23 · v1
査読・掲載
査読状況未確認
arXivで読むPDF

更新履歴

取得できた版を表示。版の更新は査読済みを意味しません。過去版の本文差分は未解析です。

原文の要旨

xlog is a CUDA-native logic programming engine integrating neural perception with deterministic Datalog, probabilistic inference, and epistemic world views through a typed frontend and provider-owned CUDA runtime. Its reasoning modes share device data planes, but their execution boundaries differ: ordinary Datalog and exact inference are host-orchestrated, while certified resident recursive and Monte Carlo sampled cores record zero tracked host-device transfers before a bounded terminal receipt. The probabilistic path supports end-to-end gradients through GPU knowledge compilation from provenance to CNF to Decision-DNNF, exact weighted model counting, and backward gradients. A final smoothed circuit is certified against its source formula before caching or evaluation. Circuit caching yields a 2.74x MNIST-addition training speedup; a worst-case-optimal join subsystem yields a 27.96x geometric-mean gain over xlog's binary-join baseline. MNIST-addition accuracy matches Scallop's (0.9561 versus 0.9468), but no per-epoch speed claim is made because baseline epoch time varies with CPU quota. In five hub-skewed triangle-counting cases, the Souffle-to-fused-xlog execution-time ratio rises from 0.88x at 150k edges, where Souffle is faster, to 5.54x at 1.2M; fused peak device allocations are 85-1,033 MB versus 3,287-44,979 MB for the materializing arm. Exact inference is correctness-equivalent to but slower than ProbLog2. On a public video benchmark, a proximity predicate trained only through symbolic credit replaces hand-set geometry at unchanged held-out accuracy; within Event-Calculus rule search it fails ten-fold cross-validation and does not transfer on a leak-free split. On a maritime corpus, weighted clauses beat crisp selection by 0.065 F1, with the result reproduced by one chronological training pass.

著者のコメント

31 pages

arXiv ID: 2609.27203 / 要約の誤りについて