10 / 3476

Wie OpenAI seinen Jalapeño-Chip mit eigenen LLMs entworfen hat

TL;DR

OpenAI hat mit Jalapeño seinen ersten eigenen AI-Beschleuniger vorgestellt. Laut OpenAI senkt der Chip die Latenz gegenüber Nvidias GB300 um bis zu 3,6x und braucht dabei weniger Strom, dazu kommen 232 GB HBM4-Speicher. Vom ersten Konzept bis zum ersten Silizium vergingen unter 20 Monate, das Team umfasste rund 100 Leute. Interne LLMs, darunter Vorläufer von GPT-6, beschleunigten das Front-end-Design und optimierten später Software-Kernels.

Nauti's Take

Unter 20 Monate vom Konzept bis zum ersten Silizium mit rund 100 Leuten ist ein starkes Signal, dass LLMs im Chipdesign einen echten Tempo-Vorteil bringen. Offen bleibt die Frage, wie belastbar die Leistungswerte sind, denn sie stammen von OpenAI selbst, und ohne Broadcom beim physischen Design wäre der Zeitplan kaum zu halten gewesen.

Hardware-Teams sollten sich den Front-end-Workflow genau anschauen, wer Nvidia-Vergleiche einordnet, wartet besser auf unabhängige Benchmarks aus dem Betrieb.

Quellen