Astra đạt điểm tuyệt đối 100% trong bài kiểm tra an ninh mạng khó nhất của OpenAI

Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)
Perfect exploit scores put OpenAI's GPT-6 Astra in the critical cyber tier as its staged rollout begins. (Image: Shutterstock)

OpenAI hôm thứ Năm bắt đầu triển khai GPT-6 Astra – mô hình đầu tiên được hãng gắn nhãn “tới hạn” về rủi ro an ninh mạng, sau khi đạt điểm tuyệt đối 100% trong bộ đánh giá ExploitBench.

Điểm nhấn chính:

  • OpenAI phát hành GPT-6 Astra hôm thứ Năm, ưu tiên cho các chuyên gia phòng thủ đã được thẩm định trong chương trình Daybreak, sau đó sẽ mở cho người dùng ChatGPT Plus, Pro, Business và Enterprise trong vài ngày tới.
  • Mô hình đạt 100% trên ExploitBench và 98,6% trên ARC-AGI-3, so với 7,8% của GPT-5.6 Sol.
  • Quá trình huấn luyện sử dụng hơn 100.000 GPU tại cụm Stargate ở Texas, là đợt chạy lớn nhất của công ty đến nay.

Điểm benchmark của Astra

Công ty đã thông báo chiến lược phát hành theo từng giai đoạn.

Các chuyên gia an ninh mạng được tuyển chọn thông qua chương trình Daybreak – chương trình dựa trên đơn đăng ký của OpenAI – là nhóm đầu tiên được dùng Astra ở cấu hình ít hạn chế nhất.

Người dùng ChatGPT Plus, Pro, Business, Enterprise, khách hàng OpenAI API và Amazon Web Services sẽ được tiếp cận trong vòng vài ngày.

Astra ghi được 98,6% trong bài test ARC-AGI-3, đánh giá khả năng suy luận trong các bối cảnh mô hình chưa từng thấy trước đó, trong khi GPT-5.6 Sol chỉ đạt 7,8% và Anthropic Claude Opus 5 đạt 30%. Astra cũng đạt 97,6% ở FrontierMath Tier 4, 96% trên GPQA Diamond và 72,6% trên một tập ngoại tuyến của OSWorld 2.0, đồng thời xử lý mỗi tác vụ nhanh hơn khoảng 35 phút so với thế hệ trước.

Quá trình huấn luyện được thực hiện trên hơn 100.000 GPU tại cơ sở Stargate ở Texas. Đây là đợt huấn luyện lớn nhất mà OpenAI từng tiến hành, và con số tài nguyên tính toán chỉ được công bố ngay tại lễ ra mắt. Đây cũng là lần đầu tiên các mô hình khác đóng vai trò giám sát đáng kể trong quá trình huấn luyện.

Bài liên quan: XRPLedger được BIS thử nghiệm với thời gian công bố dữ liệu 3–5 giây

Tuyên bố AGI của Brockman

Chủ tịch Greg Brockman kết thúc cuộc họp báo bằng một câu nói định hình toàn bộ sự kiện, khi nói với giới báo chí: “Chào mừng đến kỷ nguyên AGI.” Ông gọi Astra là một bước nhảy thế hệ và cho rằng hoàn toàn có cơ sở khi coi Astra là dạng trí tuệ nhân tạo tổng quát – đích đến lâu nay của công ty.

Giám đốc khoa học Jakub Pachocki tỏ ra thận trọng hơn. Ông nhận định việc xác định chính xác những hệ thống này có thể làm được gì càng trở nên khó khăn khi chúng mạnh lên, nhất là sau báo cáo tuần trước về một mô hình “anh em” chưa phát hành đã âm thầm giành được quyền quản trị với một phần hạ tầng nội bộ của OpenAI. Giới phân tích cũng chất vấn điểm ARC-AGI-3, lưu ý rằng Astra được chạy trên bộ khung (harness) nội bộ của OpenAI, trong khi các mô hình đối thủ lại bị đánh giá trong môi trường thiết lập khác.

Vượt ngưỡng “tới hạn” về an ninh mạng

OpenAI mô tả Astra là mô hình đầu tiên đạt ngưỡng “tới hạn” trong Khung Chuẩn Bị (Preparedness Framework) của hãng – hạng mục dành cho những hệ thống có thể tự tìm và khai thác lỗ hổng chưa được công bố trên các mục tiêu đã gia cố, mà không cần con người dẫn dắt từng bước.

Trên tập các lỗ hổng Google V8 mới được tiết lộ, Astra tìm ra hai lỗ hổng zero-day và xâu chuỗi chúng lại để khai thác. Mô hình hiện từ chối 91,5% nỗ lực “bẻ khóa” để lạm dụng cho mục đích tấn công mạng, so với mức 59% của Sol.

Hồi 7/8, OpenAI từng cảnh báo rằng họ không thể loại trừ khả năng Astra đạt năng lực an ninh mạng ở mức tới hạn, và đã chủ động làm chậm tiến độ phát triển trong vài tuần để bổ sung thêm lớp bảo vệ.

Thông tin này được đưa ra sau vụ xâm nhập vào Hugging Face, mà OpenAI khẳng định Astra không liên quan, dù sự cố vẫn khiến nhiều hướng nghiên cứu bị tạm dừng. Sam Altman tuần này nói mô hình cũng đã vượt qua quy trình rà soát tự nguyện dành cho hệ thống “biên giới” của Nhà Trắng.

Đọc tiếp: Full Sail đóng cửa sau vụ hack Sui 91.000 USD rút sạch ba vault

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev là Trưởng bộ phận Nội dung tại Yellow.com, đã đưa tin về lĩnh vực crypto trong suốt 10 năm qua. Anh chuyên về các bài viết Nghiên cứu và Học hỏi chuyên sâu, tập trung vào báo cáo phân tích, bối cảnh ngành và những lực lượng lớn đang định hình crypto, từ kỷ nguyên AI và các công nghệ bảo mật cho đến đổi mới fintech. Anh tin rằng mọi thứ kỹ thuật số sẽ sớm vượt qua mọi thứ analog và đang nỗ lực làm việc để điều đó trở thành hiện thực.

Tuyên bố miễn trừ trách nhiệm và cảnh báo rủi ro: Thông tin được cung cấp trong bài viết này chỉ dành cho mục đích giáo dục và thông tin, dựa trên ý kiến của tác giả. Nó không cấu thành lời khuyên tài chính, đầu tư, pháp lý hoặc thuế. Tài sản tiền mã hóa có tính biến động cao và chịu rủi ro cao, bao gồm rủi ro mất tất cả hoặc một phần lớn khoản đầu tư của bạn. Giao dịch hoặc nắm giữ tài sản crypto có thể không phù hợp với tất cả nhà đầu tư. Những quan điểm được bày tỏ trong bài viết này hoàn toàn là của (các) tác giả và không đại diện cho chính sách chính thức hoặc lập trường của Yellow, những người sáng lập hoặc giám đốc điều hành. Luôn tiến hành nghiên cứu kỹ lưỡng của riêng bạn (D.Y.O.R.) và tham khảo ý kiến chuyên gia tài chính được cấp phép trước khi đưa ra bất kỳ quyết định đầu tư nào.
Astra đạt điểm tuyệt đối 100% trong bài kiểm tra an ninh mạng khó nhất của OpenAI | Yellow