OpenAI mengklaim Jalapeño mengungguli Nvidia GB300 dalam dua benchmark inferensi pada level daya 700 watt, dengan rencana implementasi akhir 2026 untuk memangkas biaya dan mempercepat respons.
Pokok Penting:
- OpenAI menyatakan Jalapeño memimpin Nvidia GB300 dalam throughput per unit daya dan kecepatan respons saat pengujian.
- Chip inferensi 700 watt ini dirancang menurunkan biaya pusat data sekaligus melayani model AI dengan lebih cepat.
- Jalapeño tidak dibuat untuk pelatihan model dan tidak dibandingkan dengan generasi terbaru Nvidia, Vera Rubin.
Benchmark OpenAI
OpenAI menyampaikan bahwa prosesor khusus Jalapeño mengungguli Nvidia GB300 dalam pengujian yang mengukur beban kerja AI per unit daya dan kecepatan sistem dalam mengembalikan jawaban.
Richard Ho, pimpinan divisi chip OpenAI, mengatakan Jalapeño menggabungkan throughput tinggi dengan latensi rendah, sehingga berpotensi memberi ruang bagi pelanggan untuk memilih model yang menekankan biaya lebih murah atau jawaban lebih cepat.
Dikembangkan bersama Broadcom, Jalapeño meraih hasil pengujian tersebut pada konsumsi daya 700 watt, menurut Ho. Konsumsi listrik merupakan salah satu komponen biaya terbesar di pusat data.
Artikel Terkait: Pasar RWA Melonjak 48,7%, Namun Satu Token Jadi Penjelasan Utama
Konteks Nvidia
Perbandingan ini memiliki sejumlah keterbatasan yang jelas.
Jalapeño tidak diuji melawan generasi terbaru Nvidia, Vera Rubin, yang sudah mulai dikirim ke pelanggan, dan chip OpenAI ini memang dirancang khusus untuk inferensi, bukan pelatihan model. Nvidia tetap menjadi pemasok kunci bagi OpenAI.
OpenAI juga memanfaatkan teknologi Cerebras Systems untuk sebagian beban kerja inferensi, terutama untuk model-model yang lebih kecil, sementara Ho menyebut Jalapeño sanggup menangani model yang lebih besar. “Kebutuhan komputasi kami sangat besar,” ujarnya.
Pengujian publik memakai satu model open-source OpenAI yang lebih kecil bersama model dari DeepSeek dan Moonshot AI, dengan keunggulan Jalapeño yang lebih menonjol pada Kimi, model besar milik Moonshot. Versi kedua chip ini sudah masuk tahap lanjut, dengan proses tape-out ditargetkan dalam beberapa bulan ke depan, sementara OpenAI sudah memulai kajian konsep untuk generasi ketiga.
Chip ini merupakan kelanjutan dari pengumuman OpenAI pada 24 Juni bersama Broadcom, ketika kedua perusahaan menyatakan Jalapeño berhasil bergerak dari tahap desain ke tape-out manufaktur hanya dalam sembilan bulan berkat dukungan model OpenAI. Itulah generasi pertama.
Baca Juga: Nvidia Dukung Rencana AI Orbit 2027 SpaceX Saat Saham Keduanya Melemah

