AMD GFX1250: KI-Beschleuniger mit 1024 Registern pro Welle

Scrying the AMD GFX1250 LLVM Tea Leaves

AMD GFX1250: KI-Beschleuniger mit 1024 Registern pro Welle

Kurz vor AMDs Advancing AI Event analysiert Chips and Cheese die LLVM-Commit-Einträge zu den neuen Instinct-Beschleunigern GFX1250 (MI455X) und GFX1251 (MI430X). Der Fokus liegt auf GFX1250, der für den Helios-Rack gedacht ist. Die Analyse zeigt eine radikale Abkehr von bisherigen CDNA-Designs: Die Architektur unterstützt nur noch Wave32, führt WMMA-Tensoroperationen ein, vereint LDS und Vektor-L0-Cache zu einem 448 KB großen WGP-Cache und erlaubt bis zu 1024 VGPRs pro Welle. Zudem gibt es neue Cluster-Funktionen, die an Nvidias Hopper-Cluster erinnern, sowie 128-Byte-Atomics für die ROCm-Kommunikationsbibliothek.

Die GFX125x ist sogar noch mehr ein reiner Compute-Beschleuniger als frühere CDNA-Architekturen, da fast alle Grafikfunktionen entfernt wurden.

Mehr von diesem Tag

2026-07-19