OpenAI ngày 1/8 xác nhận Astra là dòng mô hình chủ lực tiếp theo, một hệ thống đã giải được 10 bài toán nhưng chưa phát hành, xuất hiện chỉ một tuần sau Claude Opus 5 của Anthropic.
Các điểm chính:
- OpenAI xác nhận tên Astra ngày 1/8 trong một bài nghiên cứu mô tả 10 bài toán đã được giải.
- Astra điều phối nhiều “agent” cùng xử lý một bài toán trong nhiều giờ, thậm chí nhiều ngày, và hiện chưa có lịch phát hành.
- Claude Opus 5 ra mắt ngày 24/7 với mức giá 5 USD và 25 USD cho mỗi triệu token, kèm cửa sổ ngữ cảnh 1 triệu token.
Chi tiết về mô hình OpenAI Astra
OpenAI công bố tên gọi Astra trong một bài nghiên cứu, ghi công một phiên bản nội bộ của Astra với 10 kết quả mới trong toán học và khoa học máy tính lý thuyết, đều là các bài toán mở ít nhất một thập kỷ. Công trình trải rộng từ hình học không gian chiều cao, lý thuyết mã hóa đến độ phức tạp lượng tử; trong đó có một chứng minh khẳng định sự tồn tại của các nhóm non-sofic.
Thay vì nhấn mạnh tốc độ thuần, Astra được “bán” như một hệ thống tối ưu cho bài toán dài hơi: nó điều phối nhiều “agent” cùng đào sâu một bài toán trong hàng giờ hoặc hàng ngày.
Những rò rỉ trước đó xếp Astra cạnh các họ Sol, Terra và Luna, chưa có ngày phát hành và cũng chưa quyết định sẽ gắn nhãn GPT-6 hay GPT-5.7. Sam Altman đã demo hệ thống cho các nhà lập pháp tại Washington, và dòng Astra được kỳ vọng sẽ là ứng viên đầu tiên bước vào khuôn khổ phê duyệt liên bang đang được xây dựng.
Xem thêm: Hạ tầng AI, cú rẽ 1 tỷ USD tuyệt vọng của hãng cho vay nóng để thống lĩnh trung tâm dữ liệu
Giá và hiệu năng Claude Opus 5
Anthropic ra mắt Claude Opus 5 ngày 24/7 với mức 5 USD mỗi triệu token đầu vào và 25 USD mỗi triệu token đầu ra, giữ nguyên giá so với Opus 4.8. Mô hình này dẫn đầu bảng Artificial Analysis Intelligence Index với 61 điểm, đồng thời chi phí cho mỗi tác vụ chỉ khoảng một nửa so với Fable 5.
Claude Opus 5 hỗ trợ cửa sổ ngữ cảnh 1 triệu token, trần đầu ra 128.000 token. Mô hình đạt 30,2% trên bài test ARC-AGI-3, gấp khoảng ba lần kết quả công bố tốt nhất tiếp theo, và 89,1% trên Terminal-Bench 2.1 ở mức “nỗ lực tối đa”. Người phát ngôn Anthropic khuyến nghị khách hàng nên cho các mô hình cạnh tranh chạy thử một tác vụ giới hạn rõ ràng và một bài toán dài hơi trước khi quyết định mua.
Phản ứng chuyên gia với Astra
Astra hiện chưa có bảng giá, chưa công bố benchmark và cũng chưa qua kiểm thử độc lập, đặt khách hàng vào thế phải cân nhắc giữa một sản phẩm đã thương mại hóa và một lời khẳng định từ phòng thí nghiệm.
Nhà toán học Thomas Bloom (Đại học Manchester) gọi 10 kết quả của Astra là “tin lớn” trên X, và đánh giá cao hơn những chứng minh trước đây của OpenAI.
Bloom cũng bác bỏ luận điểm rằng mô hình này sẽ thay thế nhà toán học, khi chính con người đã xây dựng nó và huấn luyện trên toàn bộ di sản mà giới toán học từng viết ra. Nhà nghiên cứu Noam Brown của OpenAI lưu ý loạt chạy này chưa chạm tới các Bài toán Thiên niên kỷ và nhóm cũng không chi quá nhiều tài nguyên cho từng bài toán.
Nhà khoa học nhận thức Gary Marcus cho rằng các kết quả là thật nhưng bị thổi phồng quá mức như thể cả lĩnh vực đã được “giải xong”.
Thông báo về Astra nối tiếp thành tựu hồi tháng 5 từ cùng họ mô hình dài hơi, khi hệ thống này bác bỏ giả thuyết Erdos về khoảng cách đơn vị, một bài toán 80 năm tuổi trong hình học rời rạc. Chủ nhân Huy chương Fields Tim Gowers khi đó nói ông sẽ không do dự đề xuất đăng tải chứng minh này trên Annals of Mathematics.
Bài tiếp theo: Tin đồn iPhone gập lộ giá: 2.500 USD, không Face ID, không camera tele





