Die Assembly Hall of Shame: 198 Milliarden Zyklen für eine einzige Instruktion

Das GitHub-Projekt „Assembly Hall of Shame“ von Christopher Domas sucht bewusst nach den langsamsten Einzelinstruktionen auf x86-Prozessoren. Durch Techniken wie MMIO-Lesezugriffe auf PCIe-Register, das Ausnutzen von Mikrocode-Assists oder das Blockieren des Speichercontrollers erreicht der aktuelle Rekordhalter, `fxrstor64` auf einem AMD Ryzen 7 5800H, eine Latenz von über 198 Milliarden Zyklen – etwa 62 Sekunden. Die Rangliste zeigt verblüffende Ergebnisse von simplen Instruktionen wie `nop` bis zu komplexen Szenarien mit Hammer-Kernen, die den PCIe-Bus sättigen.
Die Assembly Hall of Shame verfolgt den entgegengesetzten Ansatz: die absolute Untergrenze der Leistungsfähigkeit einer einzelnen Instruktion zu finden.