OpenAI meldet, dass Jalapeño den Nvidia-Chip GB300 in zwei Inferenz-Benchmarks bei 700 Watt geschlagen hat. Der Rollout ist für Ende 2026 geplant und soll die Nutzungskosten senken sowie Antwortzeiten verkürzen.
Zentrale Punkte:
- Laut OpenAI lag Jalapeño in den Tests bei Durchsatz pro Energieeinheit und Antwortgeschwindigkeit vor Nvidias GB300.
- Der 700-Watt-Inferenzchip zielt darauf ab, Rechenzentrumskosten zu drücken und KI-Modelle schneller auszuliefern.
- Jalapeño ist nicht für das Training von Modellen ausgelegt und wurde nicht gegen Nvidias neuere Generation Vera Rubin getestet.
OpenAI-Benchmarks
OpenAI teilte mit, dass der hauseigene Jalapeño-Prozessor Nvidias GB300 in Tests übertroffen habe, in denen die KI-Arbeit pro Energieeinheit sowie die Antwortgeschwindigkeit gemessen wurden.
Richard Ho, Chipchef von OpenAI, sagte, Jalapeño vereine hohen Durchsatz mit niedriger Latenz. Das könnte Kunden ermöglichen, Modelle je nach Priorität entweder auf geringere Kosten oder schnellere Antworten auszurichten.
Entwickelt mit Broadcom, erreichte Jalapeño diese Ergebnisse laut Ho bei einer Leistungsaufnahme von 700 Watt. Stromverbrauch zählt zu den größten Kostenfaktoren in Rechenzentren.
Lesen Sie auch: RWA-Markt legt um 48,7 % zu – doch ein Token erklärt fast den gesamten Anstieg
Einordnung: Nvidia
Der Vergleich hat klare Grenzen.
Jalapeño wurde nicht gegen Nvidias neuere, bereits ausgelieferte Vera-Rubin-Generation getestet. Zudem ist der OpenAI-Chip speziell für Inferenz ausgelegt, nicht für das Training großer Modelle. Nvidia bleibt für OpenAI weiterhin ein wichtiger Zulieferer.
Parallel setzt OpenAI bei bestimmten Inferenz-Workloads – vor allem mit kleineren Modellen – auf Technologie von Cerebras Systems, während Ho zufolge Jalapeño größere Modelle stemmen kann. „Unser Bedarf an Rechenleistung ist enorm“, sagte er.
In öffentlichen Tests nutzte OpenAI ein kleineres eigenes Open-Source-Modell sowie Modelle von DeepSeek und Moonshot AI. Die größten Vorteile zeigten sich bei Kimi, dem größeren Modell von Moonshot. Eine zweite Jalapeño-Generation ist bereits weit fortgeschritten; das Tape-out wird in den kommenden Monaten erwartet. Parallel hat OpenAI mit der Konzeptarbeit für eine dritte Generation begonnen.
Der Chip folgt auf OpenAIs Ankündigung vom 24. Juni gemeinsam mit Broadcom, als beide Unternehmen erklärten, Jalapeño sei binnen neun Monaten mithilfe von OpenAI-Modellen vom Design bis zum Fertigungs-Tape-out gebracht worden. Das war die erste Generation.
Als Nächstes lesen: Nvidia treibt SpaceXs Orbital-KI-Pläne für 2027 voran – während beide Aktien nachgeben





