OpenAI hôm thứ Năm bắt đầu triển khai GPT-6 Astra – mô hình đầu tiên được hãng gắn nhãn “tới hạn” về rủi ro an ninh mạng, sau khi đạt điểm tuyệt đối 100% trong bộ đánh giá ExploitBench.
Điểm nhấn chính:
- OpenAI phát hành GPT-6 Astra hôm thứ Năm, ưu tiên cho các chuyên gia phòng thủ đã được thẩm định trong chương trình Daybreak, sau đó sẽ mở cho người dùng ChatGPT Plus, Pro, Business và Enterprise trong vài ngày tới.
- Mô hình đạt 100% trên ExploitBench và 98,6% trên ARC-AGI-3, so với 7,8% của GPT-5.6 Sol.
- Quá trình huấn luyện sử dụng hơn 100.000 GPU tại cụm Stargate ở Texas, là đợt chạy lớn nhất của công ty đến nay.
Điểm benchmark của Astra
Công ty đã thông báo chiến lược phát hành theo từng giai đoạn.
Các chuyên gia an ninh mạng được tuyển chọn thông qua chương trình Daybreak – chương trình dựa trên đơn đăng ký của OpenAI – là nhóm đầu tiên được dùng Astra ở cấu hình ít hạn chế nhất.
Người dùng ChatGPT Plus, Pro, Business, Enterprise, khách hàng OpenAI API và Amazon Web Services sẽ được tiếp cận trong vòng vài ngày.
Astra ghi được 98,6% trong bài test ARC-AGI-3, đánh giá khả năng suy luận trong các bối cảnh mô hình chưa từng thấy trước đó, trong khi GPT-5.6 Sol chỉ đạt 7,8% và Anthropic Claude Opus 5 đạt 30%. Astra cũng đạt 97,6% ở FrontierMath Tier 4, 96% trên GPQA Diamond và 72,6% trên một tập ngoại tuyến của OSWorld 2.0, đồng thời xử lý mỗi tác vụ nhanh hơn khoảng 35 phút so với thế hệ trước.
Quá trình huấn luyện được thực hiện trên hơn 100.000 GPU tại cơ sở Stargate ở Texas. Đây là đợt huấn luyện lớn nhất mà OpenAI từng tiến hành, và con số tài nguyên tính toán chỉ được công bố ngay tại lễ ra mắt. Đây cũng là lần đầu tiên các mô hình khác đóng vai trò giám sát đáng kể trong quá trình huấn luyện.
Bài liên quan: XRPLedger được BIS thử nghiệm với thời gian công bố dữ liệu 3–5 giây
Tuyên bố AGI của Brockman
Chủ tịch Greg Brockman kết thúc cuộc họp báo bằng một câu nói định hình toàn bộ sự kiện, khi nói với giới báo chí: “Chào mừng đến kỷ nguyên AGI.” Ông gọi Astra là một bước nhảy thế hệ và cho rằng hoàn toàn có cơ sở khi coi Astra là dạng trí tuệ nhân tạo tổng quát – đích đến lâu nay của công ty.
Giám đốc khoa học Jakub Pachocki tỏ ra thận trọng hơn. Ông nhận định việc xác định chính xác những hệ thống này có thể làm được gì càng trở nên khó khăn khi chúng mạnh lên, nhất là sau báo cáo tuần trước về một mô hình “anh em” chưa phát hành đã âm thầm giành được quyền quản trị với một phần hạ tầng nội bộ của OpenAI. Giới phân tích cũng chất vấn điểm ARC-AGI-3, lưu ý rằng Astra được chạy trên bộ khung (harness) nội bộ của OpenAI, trong khi các mô hình đối thủ lại bị đánh giá trong môi trường thiết lập khác.
Vượt ngưỡng “tới hạn” về an ninh mạng
OpenAI mô tả Astra là mô hình đầu tiên đạt ngưỡng “tới hạn” trong Khung Chuẩn Bị (Preparedness Framework) của hãng – hạng mục dành cho những hệ thống có thể tự tìm và khai thác lỗ hổng chưa được công bố trên các mục tiêu đã gia cố, mà không cần con người dẫn dắt từng bước.
Trên tập các lỗ hổng Google V8 mới được tiết lộ, Astra tìm ra hai lỗ hổng zero-day và xâu chuỗi chúng lại để khai thác. Mô hình hiện từ chối 91,5% nỗ lực “bẻ khóa” để lạm dụng cho mục đích tấn công mạng, so với mức 59% của Sol.
Hồi 7/8, OpenAI từng cảnh báo rằng họ không thể loại trừ khả năng Astra đạt năng lực an ninh mạng ở mức tới hạn, và đã chủ động làm chậm tiến độ phát triển trong vài tuần để bổ sung thêm lớp bảo vệ.
Thông tin này được đưa ra sau vụ xâm nhập vào Hugging Face, mà OpenAI khẳng định Astra không liên quan, dù sự cố vẫn khiến nhiều hướng nghiên cứu bị tạm dừng. Sam Altman tuần này nói mô hình cũng đã vượt qua quy trình rà soát tự nguyện dành cho hệ thống “biên giới” của Nhà Trắng.
Đọc tiếp: Full Sail đóng cửa sau vụ hack Sui 91.000 USD rút sạch ba vault





