OpenAI ngày 1/8 xác nhận Astra là dòng mô hình chủ lực tiếp theo – một hệ thống đã giải 10 bài toán toán học nhưng vẫn chưa công bố – chỉ một tuần sau khi Anthropic tung ra Claude Opus 5.
Những điểm chính:
- OpenAI xác nhận tên Astra ngày 1/8 trong một bài nghiên cứu mô tả 10 bài toán được giải.
- Astra điều phối nhiều “agent” cùng xử lý một bài toán trong nhiều giờ hoặc nhiều ngày, hiện chưa có ngày phát hành.
- Claude Opus 5 ra mắt 24/7 với giá 5 USD và 25 USD trên mỗi triệu token, kèm cửa sổ ngữ cảnh 1 triệu token.
Chi tiết về mô hình OpenAI Astra
OpenAI công bố tên Astra trong một bài viết nghiên cứu, ghi nhận một phiên bản nội bộ của Astra với 10 kết quả mới trong toán học và khoa học máy tính lý thuyết, mỗi bài toán đã “treo” ít nhất một thập kỷ. Công trình trải rộng từ hình học không gian chiều cao, lý thuyết mã hóa tới độ phức tạp lượng tử, trong đó có một chứng minh về sự tồn tại của các nhóm non‑sofic.
Thông điệp cốt lõi của Astra không phải tốc độ tức thời mà là khả năng “chịu đựng đường dài”: mô hình điều phối nhiều agent cùng tập trung vào một bài toán duy nhất trong nhiều giờ, thậm chí nhiều ngày.
Các nguồn tin trước đó xếp Astra bên cạnh các dòng Sol, Terra và Luna, chưa có lịch phát hành cũng như chưa chốt gọi tên là GPT‑6 hay GPT‑5.7. Sam Altman đã trình diễn hệ thống này với các nhà lập pháp tại Washington, và nhiều khả năng Astra sẽ là một trong những dòng mô hình đầu tiên phải qua quy trình thẩm định theo khung phê duyệt liên bang đang được xây dựng.
Đọc thêm: Hạ tầng AI, cú xoay trục 1 tỷ USD tuyệt vọng của hãng cho vay nóng sang chiếm lĩnh data center
Giá và hiệu năng Claude Opus 5
Anthropic ra mắt Claude Opus 5 ngày 24/7 với giá 5 USD mỗi triệu token đầu vào và 25 USD mỗi triệu token đầu ra, giữ nguyên mặt bằng giá so với Opus 4.8. Mô hình này dẫn đầu bảng Artificial Analysis Intelligence Index với 61 điểm, trong khi chi phí mỗi tác vụ chỉ khoảng một nửa so với Fable 5.
Claude Opus 5 hỗ trợ cửa sổ ngữ cảnh 1 triệu token và giới hạn đầu ra ở 128.000 token. Mô hình đạt 30,2% trên bài test ARC‑AGI‑3, gấp khoảng ba lần kết quả công bố tốt thứ hai, và 89,1% trên Terminal‑Bench 2.1 ở cấu hình nỗ lực tối đa. Người phát ngôn Anthropic khuyến nghị khách hàng nên chạy thử các mô hình cạnh tranh trên một nhiệm vụ có phạm vi rõ ràng và một tác vụ dài hạn trước khi quyết định lựa chọn.
Phản ứng chuyên gia về Astra
Astra hiện chưa có bảng giá, chưa có kết quả benchmark công khai và cũng chưa được kiểm chứng độc lập, buộc khách hàng phải cân giữa một sản phẩm đã bán thương mại và một bộ kết quả mang tính nghiên cứu.
Nhà toán học Thomas Bloom của Đại học Manchester gọi 10 kết quả này là “tin lớn” trên X, và đánh giá chúng còn ấn tượng hơn chứng minh trước đó của OpenAI.
Bloom cũng bác bỏ các tuyên bố cho rằng mô hình có thể “thay thế” nhà toán học, nhấn mạnh chính con người đã xây dựng hệ thống và huấn luyện nó trên toàn bộ những gì giới toán học đã viết ra. Nhà nghiên cứu Noam Brown của OpenAI lưu ý Astra chưa chạm tới bất kỳ Bài toán Thiên niên kỷ nào, và nhóm cũng không chi quá nhiều tài nguyên cho mỗi bài toán.
Nhà khoa học nhận thức Gary Marcus nhận định các kết quả là có thật nhưng đang bị thổi phồng quá mức như thể cả lĩnh vực đã được giải quyết.
Thông báo về Astra được đưa ra sau một kết quả hồi tháng 5 từ cùng “họ” mô hình tầm nhìn dài hạn này, khi hệ thống bác bỏ giả thuyết khoảng cách đơn vị Erdos – một bài toán 80 năm tuổi trong hình học rời rạc. Chủ nhân Huy chương Fields Tim Gowers khi đó cho biết ông sẵn sàng đề xuất đăng chứng minh này lên Annals of Mathematics mà không hề do dự.
Bài tiếp theo: Tin đồn iPhone gập trở nên cụ thể: 2.500 USD, không Face ID, không telephoto






