OpenAI Jalapeño übertrifft Nvidia Blackwell bei der Inferenz

OpenAI Jalapeño: Better than Nvidia Blackwell

OpenAI Jalapeño übertrifft Nvidia Blackwell bei der Inferenz

OpenAI hat auf der Hot Chips seinen Inferenz-Chip Jalapeño vorgestellt, der in nur 16 Monaten von der Teambildung bis zum Tape-out entwickelt wurde. SemiAnalysis hat den Chip mit seiner InferenceX-Benchmark-Suite getestet und festgestellt, dass er Nvidia, AMD und Google in puncto Tokens pro Watt übertrifft – sogar ohne Multi-Token-Prediction. Der Chip ist ein generalisierter Inferenzbeschleuniger, der nicht auf OpenAI-Modelle spezialisiert ist, und nutzt HBM4. Trotz beeindruckender Ergebnisse weist SemiAnalysis auf Einschränkungen hin: Die Benchmarks umfassen nur 8k1k-Workloads, und ein Vergleich mit Nvidias kommendem Rubin steht noch aus.

Jalapeño raucht jeden anderen Chip – und das alles ohne Multi-Token-Prediction, während die anderen Chips in der Tabelle die besten Konfigurationen mit MTP sind.

Mehr von diesem Tag

2026-08-25