OpenAI meldet, dass der Jalapeño-Chip den Nvidia GB300 in zwei Inferenz-Benchmarks bei 700 Watt geschlagen hat. Der Einsatz ist für Ende 2026 geplant, um Kosten zu senken und Antwortzeiten zu verkürzen.
Zentrale Punkte:
- OpenAI zufolge lag Jalapeño in den Tests vor Nvidias GB300 bei Durchsatz pro Leistungseinheit und Antwortgeschwindigkeit.
- Der 700-Watt-Inferenzchip soll Rechenzentrumskosten drücken und KI-Modelle schneller ausliefern.
- Jalapeño ist nicht für das Training von Modellen ausgelegt und wurde nicht gegen Nvidias neuere Vera-Rubin-Generation getestet.
OpenAI-Benchmarks
OpenAI teilte mit, dass der eigens entwickelte Jalapeño-Prozessor Nvidias GB300 in Tests übertroffen habe, die sowohl KI-Arbeit pro Leistungseinheit als auch die Antwortgeschwindigkeit messen.
Richard Ho, Chipchef von OpenAI, sagte, Jalapeño verbinde hohen Durchsatz mit niedriger Latenz. Kunden könnten dadurch Modelle wählen, die entweder besonders kostengünstig oder besonders schnell antworten.
Entwickelt gemeinsam mit Broadcom, erzielte Jalapeño seine Testergebnisse laut Ho bei einer Leistungsaufnahme von 700 Watt. Strom ist einer der größten Kostenblöcke in Rechenzentren.
Auch interessant: RWA-Markt legt 48,7 % zu – doch ein Token erklärt fast den gesamten Anstieg
Einordnung zu Nvidia
Der Vergleich hat klare Grenzen.
Jalapeño wurde nicht gegen Nvidias neue Vera-Rubin-Generation getestet, die bereits ausgeliefert wird. Zudem ist der OpenAI-Chip auf Inferenz, nicht auf das Training von Modellen ausgelegt. Nvidia bleibt ein zentraler Zulieferer.
Parallel setzt OpenAI bei bestimmten Inferenz-Workloads – vor allem mit kleineren Modellen – auf Technologie von Cerebras Systems, während Ho zufolge Jalapeño größere Modelle bedienen kann. „Wir haben einen enormen Bedarf an Rechenleistung“, sagte er.
In öffentlichen Tests nutzte OpenAI ein kleineres eigenes Open-Source-Modell sowie Modelle von DeepSeek und Moonshot AI; die größten Vorteile zeigten sich beim größeren Kimi-Modell von Moonshot. Eine zweite Jalapeño-Generation ist bereits weit fortgeschritten, das Tape-out wird in den kommenden Monaten erwartet. Parallel hat OpenAI konzeptionelle Arbeiten an einer dritten Generation begonnen.
Der Chip folgt auf die gemeinsame Ankündigung von OpenAI und Broadcom vom 24. Juni: Damals erklärten die Unternehmen, Jalapeño sei mit Hilfe von OpenAI-Modellen in nur neun Monaten von der Designphase bis zum Fertigungs-Tape-out gekommen. Das war die erste Generation.
Weiterlesen: Nvidia treibt SpaceX’ Orbital-KI-Pläne für 2027 – trotz Kursrückgang bei beiden Aktien

