
OpenAI Jalapeño-Chip übertrifft Nvidia Blackwell bei Inferenz-Benchmarks
Der Jalapeño-Chip wurde erstmals im Oktober 2025 angekündigt und von OpenAI in enger Zusammenarbeit mit Broadcom entwickelt — OpenAIs eigene Modelle waren dabei am Entwicklungsprozess beteiligt. Auf der Hot Chips-Konferenz präsentierte Richard Ho, OpenAIs Hardware-Chef, die ersten konkreten Benchmark-Zahlen: Im SemiAnalysis-InferenceX-Benchmark übertrifft Jalapeño aktuell verfügbare Inferenzprozessoren sowohl bei Tokens pro Nutzer als auch beim Durchsatz pro Kilowatt. Als Vergleichsreferenz diente ein Nvidia-Blackwell-System — was die Einordnung erschwert, da Nvidia bis zur vollständigen Jalapeño-Auslieferung 2027 neue Produkte auf den Markt gebracht haben dürfte. OpenAI verfolgt mit Jalapeño einen expliziten Full-Stack-Ansatz, bei dem KI-Produkte, Modelle, Chips und Speicher aufeinander abgestimmt entwickelt werden. Dieser Ansatz ermöglicht es, spezifische Engpässe im Inferenzprozess gezielt anzugehen — insbesondere in der Prefill-Phase und bei der Kommunikation zwischen Komponenten. Das System erlaubt die explizite Platzierung des KV-Cache, sodass der Modellzustand lokal gehalten wird, während die richtige Kombination aus Rechenleistung, Speicher und Netzwerk je nach Inferenzphase aktiviert wird. OpenAI plant Jalapeño als multigenerationale Plattform, die über mehrere Chip-Generationen hinweg weiterentwickelt werden soll.
- Erstankündigung: Jalapeño wurde bereits im Oktober 2025 erstmals öffentlich vorgestellt — Hot Chips war der erste Auftritt mit konkreten Benchmark-Daten.
- Entwicklungspartner Broadcom: Der Chip entstand in enger Kollaboration mit Broadcom; OpenAIs eigene KI-Modelle unterstützten den Designprozess.
- Deployment-Zeitplan: Ende 2026 sollen erste Einheiten in sehr kleinen Stückzahlen ausgeliefert werden, ein nennenswerter Einsatz ist erst 2027 geplant.
- Multigenerationale Plattform: OpenAI will Chips, Modelle, Speicher und KI-Produkte künftig im Gleichschritt weiterentwickeln — kein Einmal-Chip, sondern eine langfristige Hardware-Strategie.
- Benchmarking durch SemiAnalysis: Der InferenceX-Benchmark stammt vom unabhängigen Analyse-Haus SemiAnalysis und vergleicht Tokens/Nutzer sowie Durchsatz/Kilowatt.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.

OpenAI Jalapeño-Chip übertrifft Nvidia Blackwell bei Inferenz-Benchmarks
Der Jalapeño-Chip wurde erstmals im Oktober 2025 angekündigt und von OpenAI in enger Zusammenarbeit mit Broadcom entwickelt — OpenAIs eigene Modelle waren dabei am Entwicklungsprozess beteiligt. Auf der Hot Chips-Konferenz präsentierte Richard Ho, OpenAIs Hardware-Chef, die ersten konkreten Benchmark-Zahlen: Im SemiAnalysis-InferenceX-Benchmark übertrifft Jalapeño aktuell verfügbare Inferenzprozessoren sowohl bei Tokens pro Nutzer als auch beim Durchsatz pro Kilowatt. Als Vergleichsreferenz diente ein Nvidia-Blackwell-System — was die Einordnung erschwert, da Nvidia bis zur vollständigen Jalapeño-Auslieferung 2027 neue Produkte auf den Markt gebracht haben dürfte. OpenAI verfolgt mit Jalapeño einen expliziten Full-Stack-Ansatz, bei dem KI-Produkte, Modelle, Chips und Speicher aufeinander abgestimmt entwickelt werden. Dieser Ansatz ermöglicht es, spezifische Engpässe im Inferenzprozess gezielt anzugehen — insbesondere in der Prefill-Phase und bei der Kommunikation zwischen Komponenten. Das System erlaubt die explizite Platzierung des KV-Cache, sodass der Modellzustand lokal gehalten wird, während die richtige Kombination aus Rechenleistung, Speicher und Netzwerk je nach Inferenzphase aktiviert wird. OpenAI plant Jalapeño als multigenerationale Plattform, die über mehrere Chip-Generationen hinweg weiterentwickelt werden soll.
- Erstankündigung: Jalapeño wurde bereits im Oktober 2025 erstmals öffentlich vorgestellt — Hot Chips war der erste Auftritt mit konkreten Benchmark-Daten.
- Entwicklungspartner Broadcom: Der Chip entstand in enger Kollaboration mit Broadcom; OpenAIs eigene KI-Modelle unterstützten den Designprozess.
- Deployment-Zeitplan: Ende 2026 sollen erste Einheiten in sehr kleinen Stückzahlen ausgeliefert werden, ein nennenswerter Einsatz ist erst 2027 geplant.
- Multigenerationale Plattform: OpenAI will Chips, Modelle, Speicher und KI-Produkte künftig im Gleichschritt weiterentwickeln — kein Einmal-Chip, sondern eine langfristige Hardware-Strategie.
- Benchmarking durch SemiAnalysis: Der InferenceX-Benchmark stammt vom unabhängigen Analyse-Haus SemiAnalysis und vergleicht Tokens/Nutzer sowie Durchsatz/Kilowatt.
Frag die KI zum Artikel
Folgefragen zu Headline, Quelle und Volltext — Antwort streamt in wenigen Sekunden.