「正しい」と判定されたLLM生成GPUカーネルの62%に欠陥があった — 12の厳格ゲートで緩すぎる評価基準を解剖する
DRANK

8月14日、Rishi ShahとRishav Shresthaが「A Contract-Grade Verifier for LLM-Generated GPU Kernels, and a Native Blackwell Backward for the Gated-Linear-Recurrence Family」と題した論文を公開した。LLMが生成したGPUカーネルの正しさを厳密に検証するシステムを構築し、既存の評価手法が見逃してきた重大な欠陥を数値で示した研究だ。

by @tf_official
Related Topics: AI Code Generator CUDA AI