Vertragsstufen-Verifizierer entlarvt 39,5 % der LLM-generierten GPU-Kernel als fehlerhaft
A Contract-Grade Verifier for LLM-Generated GPU Kernels

Systeme, die GPU-Kernel mit Sprachmodellen erzeugen, melden hohe Korrektheitsraten – doch diese basieren oft nur auf einem einzigen lockeren Test. Ein neuer Verifizierer mit zwölf toleranzfreien Prüfungen deckt auf: 39,5 % der von einem öffentlichen System akzeptierten Kernel sind grundlegend fehlerhaft, 62,1 % verletzen mindestens eine Bedingung. Der Verifizierer wird auch auf einen eigenen Kernel angewendet: den ersten nativen Blackwell-tcgen05-Trainings-Backward für die Gated-Linear-Recurrence-Familie.
Das Korrektheitssignal hinter dem berichteten Fortschritt in der Kernel-Erzeugung ist weit schwächer, als die Zahlen vermuten lassen.