OpenAI cho biết chip Jalapeño của hãng đã vượt Nvidia GB300 trong hai bài kiểm thử suy luận ở mức công suất 700 watt, với kế hoạch triển khai rộng rãi vào cuối năm 2026 nhằm cắt giảm chi phí và tăng tốc độ phản hồi.
Các điểm chính:
- OpenAI khẳng định Jalapeño dẫn trước GB300 của Nvidia về thông lượng trên mỗi đơn vị điện năng và tốc độ phản hồi trong quá trình thử nghiệm.
- Con chip suy luận 700 watt được thiết kế để giảm chi phí vận hành trung tâm dữ liệu, đồng thời phục vụ mô hình AI nhanh hơn.
- Jalapeño không dành cho huấn luyện mô hình và cũng chưa được so sánh với thế hệ Vera Rubin mới hơn của Nvidia.
Kết quả benchmark của OpenAI
OpenAI cho biết bộ xử lý tùy chỉnh Jalapeño đã vượt trội so với Nvidia GB300 trong các bài test đo lường khối lượng công việc AI xử lý được trên mỗi đơn vị điện năng và tốc độ trả lời kết quả.
Richard Ho, lãnh đạo mảng chip của OpenAI, nói Jalapeño kết hợp được thông lượng cao với độ trễ thấp, mở ra khả năng cho khách hàng lựa chọn giữa mô hình ưu tiên chi phí rẻ hơn hoặc câu trả lời nhanh hơn.
Được phát triển cùng Broadcom, Jalapeño đạt những kết quả này khi vận hành ở mức 700 watt, theo Ho. Chi phí điện năng là một trong những gánh nặng lớn nhất của trung tâm dữ liệu.
Bài viết liên quan: Thị trường RWA tăng 48,7%, nhưng gần như chỉ một token quyết định
Bối cảnh phía Nvidia
So sánh giữa hai bên có những giới hạn rõ ràng.
Jalapeño chưa được thử nghiệm đối đầu với thế hệ Vera Rubin mới hơn của Nvidia — dòng chip đã bắt đầu được giao — và thiết kế của chip OpenAI tập trung vào suy luận chứ không phải huấn luyện mô hình. Nvidia vẫn là nhà cung cấp trọng yếu của hãng.
OpenAI cũng đang sử dụng công nghệ của Cerebras Systems cho một số tác vụ suy luận, đặc biệt với các mô hình nhỏ hơn, trong khi Ho cho biết Jalapeño có thể gánh các mô hình lớn. “Chúng tôi có nhu cầu tính toán khổng lồ,” ông nói.
Các bài test công khai sử dụng một mô hình nguồn mở cỡ nhỏ của OpenAI cùng với mô hình của DeepSeek và Moonshot AI, trong đó lợi thế rõ rệt hơn xuất hiện trên mô hình Kimi kích thước lớn của Moonshot. Phiên bản thứ hai của Jalapeño đã ở giai đoạn khá hoàn thiện, với tape-out được kỳ vọng trong vài tháng tới, trong khi OpenAI đã bắt tay vào thiết kế khái niệm cho thế hệ thứ ba.
Con chip này tiếp nối thông báo ngày 24/6 của OpenAI và Broadcom, khi hai bên cho biết Jalapeño đã chuyển từ giai đoạn thiết kế sang tape-out sản xuất chỉ trong chín tháng nhờ hỗ trợ từ chính các mô hình OpenAI. Đó là thế hệ đầu tiên.
Bài viết tiếp theo: Nvidia tiếp sức kế hoạch AI quỹ đạo 2027 của SpaceX trong khi cả hai cổ phiếu cùng giảm





