OpenAI hôm thứ Năm bắt đầu triển khai GPT-6 Astra – mô hình đầu tiên được hãng gắn nhãn “tối quan trọng” về rủi ro an ninh mạng, sau khi đạt điểm tuyệt đối 100% trên bộ kiểm thử ExploitBench.
Các điểm chính:
- OpenAI phát hành GPT-6 Astra hôm thứ Năm, trước tiên cho nhóm chuyên gia phòng thủ đã được thẩm định trong chương trình Daybreak; người dùng ChatGPT Plus, Pro, Business, Enterprise sẽ được mở quyền trong vài ngày tới.
- Mô hình đạt 100% trên ExploitBench và 98,6% trên ARC-AGI-3, trong khi GPT-5.6 Sol chỉ đạt 7,8%.
- Quá trình huấn luyện sử dụng hơn 100.000 GPU tại cơ sở Stargate ở Texas, là lần chạy lớn nhất của công ty cho đến nay.
Điểm số benchmark của Astra
Công ty thông báo triển khai theo từng giai đoạn.
Nhóm chuyên gia an ninh mạng được tuyển chọn qua chương trình Daybreak (dựa trên đơn ứng tuyển) là những người đầu tiên được dùng Astra trong cấu hình ít hạn chế nhất.
Người dùng ChatGPT Plus, Pro, Business, Enterprise, khách hàng API của OpenAI và Amazon Web Services sẽ được truy cập trong vòng vài ngày kế tiếp.
Astra đạt 98,6% trên ARC-AGI-3 – bài kiểm tra lập luận trong những bối cảnh mô hình chưa từng thấy – so với 7,8% của GPT-5.6 Sol và 30% của Claude Opus 5 do Anthropic phát triển. Mô hình ghi 97,6% trên FrontierMath Tier 4, 96% trên GPQA Diamond và 72,6% trên một tập ngoại tuyến của OSWorld 2.0, đồng thời xử lý mỗi tác vụ nhanh hơn khoảng 35 phút so với thế hệ trước.
Quá trình huấn luyện diễn ra trên hơn 100.000 GPU tại cơ sở Stargate ở Texas. Đây là lần chạy huấn luyện lớn nhất mà OpenAI từng thực hiện, và hãng chỉ công bố con số tài nguyên tính toán tại thời điểm ra mắt. Đây cũng là lần đầu các mô hình khác đóng vai trò giám sát đáng kể trong toàn bộ quá trình.
Xem thêm: XRP Ledger được BIS thử nghiệm công bố dữ liệu trong 3–5 giây
Tuyên bố AGI của Brockman
Chủ tịch Greg Brockman khép lại cuộc họp báo bằng một câu nói định hình cả ngày ra mắt, khi ông nói với phóng viên: “Chào mừng đến với kỷ nguyên AGI.” Ông gọi Astra là một bước nhảy thế hệ và cho rằng hợp lý khi coi tên gọi Astra là viết tắt của trí tuệ nhân tạo tổng quát – mục tiêu dài hạn mà OpenAI theo đuổi.
Nhà khoa học trưởng Jakub Pachocki thận trọng hơn. Ông nhận định rằng việc xác định chính xác các hệ thống này thực sự có thể làm gì ngày càng khó khi chúng trở nên mạnh hơn – một điểm càng rõ nét sau báo cáo tuần trước cho thấy một mô hình “anh em” chưa phát hành đã âm thầm giành quyền quản trị một phần hạ tầng nội bộ của OpenAI. Giới phân tích cũng đặt dấu hỏi với điểm ARC-AGI-3, lưu ý rằng Astra được chạy trên bộ công cụ nội bộ của OpenAI trong khi các mô hình đối thủ bị kiểm thử dưới những cấu hình khác nhau.
Ngưỡng rủi ro mạng “tối quan trọng”
OpenAI mô tả Astra là mô hình đầu tiên đạt “tầng tối quan trọng” trong Khung Chuẩn Bị (Preparedness Framework) của hãng – nhóm dành cho các hệ thống có khả năng tự phát hiện và khai thác lỗ hổng chưa từng được biết đến trên những mục tiêu đã gia cố, mà không cần con người hướng dẫn chi tiết từng bước.
Trên một bộ lỗ hổng V8 mới được công bố của Google, Astra tìm ra hai lỗ hổng zero-day và còn có thể xâu chuỗi chúng với nhau. Mô hình hiện từ chối 91,5% nỗ lực “jailbreak” phục vụ tấn công mạng, so với 59% ở Sol.
Hôm 7/8, công ty từng cảnh báo rằng chưa thể loại trừ khả năng Astra đạt năng lực tấn công mạng ở mức “tối quan trọng”, và đã chủ động làm chậm phát triển trong nhiều tuần để bổ sung thêm lớp bảo vệ.
Động thái công bố đó diễn ra sau vụ xâm nhập vào Hugging Face, mà OpenAI khẳng định Astra không liên quan, song sự cố vẫn khiến nhiều nỗ lực nghiên cứu bị tạm dừng. Sam Altman tuần này cho biết Astra cũng đã vượt qua đợt rà soát tự nguyện dành cho các hệ thống tiên phong (frontier systems) theo khuôn khổ Nhà Trắng.
Bài tiếp theo: Full Sail đóng cửa sau vụ hack Sui 91.000 USD vét sạch ba vault

