Astra đạt 100% trên bộ kiểm thử mạng khó nhất của OpenAI

Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)
Court action over flagged ChatGPT threats puts OpenAI under scrutiny after the Tumbler Ridge shooting (Image: Shutterstock)

OpenAI hôm thứ Năm bắt đầu triển khai GPT-6 Astra – mô hình đầu tiên được hãng gắn nhãn “tối quan trọng” về rủi ro an ninh mạng, sau khi đạt điểm tuyệt đối 100% trên bộ kiểm thử ExploitBench.

Các điểm chính:

  • OpenAI phát hành GPT-6 Astra hôm thứ Năm, trước tiên cho nhóm chuyên gia phòng thủ đã được thẩm định trong chương trình Daybreak; người dùng ChatGPT Plus, Pro, Business, Enterprise sẽ được mở quyền trong vài ngày tới.
  • Mô hình đạt 100% trên ExploitBench và 98,6% trên ARC-AGI-3, trong khi GPT-5.6 Sol chỉ đạt 7,8%.
  • Quá trình huấn luyện sử dụng hơn 100.000 GPU tại cơ sở Stargate ở Texas, là lần chạy lớn nhất của công ty cho đến nay.

Điểm số benchmark của Astra

Công ty thông báo triển khai theo từng giai đoạn.

Nhóm chuyên gia an ninh mạng được tuyển chọn qua chương trình Daybreak (dựa trên đơn ứng tuyển) là những người đầu tiên được dùng Astra trong cấu hình ít hạn chế nhất.

Người dùng ChatGPT Plus, Pro, Business, Enterprise, khách hàng API của OpenAI và Amazon Web Services sẽ được truy cập trong vòng vài ngày kế tiếp.

Astra đạt 98,6% trên ARC-AGI-3 – bài kiểm tra lập luận trong những bối cảnh mô hình chưa từng thấy – so với 7,8% của GPT-5.6 Sol và 30% của Claude Opus 5 do Anthropic phát triển. Mô hình ghi 97,6% trên FrontierMath Tier 4, 96% trên GPQA Diamond và 72,6% trên một tập ngoại tuyến của OSWorld 2.0, đồng thời xử lý mỗi tác vụ nhanh hơn khoảng 35 phút so với thế hệ trước.

Quá trình huấn luyện diễn ra trên hơn 100.000 GPU tại cơ sở Stargate ở Texas. Đây là lần chạy huấn luyện lớn nhất mà OpenAI từng thực hiện, và hãng chỉ công bố con số tài nguyên tính toán tại thời điểm ra mắt. Đây cũng là lần đầu các mô hình khác đóng vai trò giám sát đáng kể trong toàn bộ quá trình.

Xem thêm: XRP Ledger được BIS thử nghiệm công bố dữ liệu trong 3–5 giây

Tuyên bố AGI của Brockman

Chủ tịch Greg Brockman khép lại cuộc họp báo bằng một câu nói định hình cả ngày ra mắt, khi ông nói với phóng viên: “Chào mừng đến với kỷ nguyên AGI.” Ông gọi Astra là một bước nhảy thế hệ và cho rằng hợp lý khi coi tên gọi Astra là viết tắt của trí tuệ nhân tạo tổng quát – mục tiêu dài hạn mà OpenAI theo đuổi.

Nhà khoa học trưởng Jakub Pachocki thận trọng hơn. Ông nhận định rằng việc xác định chính xác các hệ thống này thực sự có thể làm gì ngày càng khó khi chúng trở nên mạnh hơn – một điểm càng rõ nét sau báo cáo tuần trước cho thấy một mô hình “anh em” chưa phát hành đã âm thầm giành quyền quản trị một phần hạ tầng nội bộ của OpenAI. Giới phân tích cũng đặt dấu hỏi với điểm ARC-AGI-3, lưu ý rằng Astra được chạy trên bộ công cụ nội bộ của OpenAI trong khi các mô hình đối thủ bị kiểm thử dưới những cấu hình khác nhau.

Ngưỡng rủi ro mạng “tối quan trọng”

OpenAI mô tả Astra là mô hình đầu tiên đạt “tầng tối quan trọng” trong Khung Chuẩn Bị (Preparedness Framework) của hãng – nhóm dành cho các hệ thống có khả năng tự phát hiện và khai thác lỗ hổng chưa từng được biết đến trên những mục tiêu đã gia cố, mà không cần con người hướng dẫn chi tiết từng bước.

Trên một bộ lỗ hổng V8 mới được công bố của Google, Astra tìm ra hai lỗ hổng zero-day và còn có thể xâu chuỗi chúng với nhau. Mô hình hiện từ chối 91,5% nỗ lực “jailbreak” phục vụ tấn công mạng, so với 59% ở Sol.

Hôm 7/8, công ty từng cảnh báo rằng chưa thể loại trừ khả năng Astra đạt năng lực tấn công mạng ở mức “tối quan trọng”, và đã chủ động làm chậm phát triển trong nhiều tuần để bổ sung thêm lớp bảo vệ.

Động thái công bố đó diễn ra sau vụ xâm nhập vào Hugging Face, mà OpenAI khẳng định Astra không liên quan, song sự cố vẫn khiến nhiều nỗ lực nghiên cứu bị tạm dừng. Sam Altman tuần này cho biết Astra cũng đã vượt qua đợt rà soát tự nguyện dành cho các hệ thống tiên phong (frontier systems) theo khuôn khổ Nhà Trắng.

Bài tiếp theo: Full Sail đóng cửa sau vụ hack Sui 91.000 USD vét sạch ba vault

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev là Trưởng bộ phận Nội dung tại Yellow.com, đã đưa tin về lĩnh vực tiền mã hóa trong 10 năm qua. Anh chuyên về các bài Nghiên cứu chuyên sâu và Học hỏi, tập trung vào báo cáo phân tích, bối cảnh ngành và những lực lượng lớn đang định hình thị trường crypto, từ kỷ nguyên AI và các công nghệ bảo mật đến đổi mới fintech. Anh tin rằng mọi thứ kỹ thuật số sẽ sớm vượt qua mọi thứ tương tự và đang nỗ lực làm việc để điều đó trở thành hiện thực.

Tuyên bố miễn trừ trách nhiệm và cảnh báo rủi ro: Thông tin được cung cấp trong bài viết này chỉ dành cho mục đích giáo dục và thông tin, dựa trên ý kiến của tác giả. Nó không cấu thành lời khuyên tài chính, đầu tư, pháp lý hoặc thuế. Tài sản tiền mã hóa có tính biến động cao và chịu rủi ro cao, bao gồm rủi ro mất tất cả hoặc một phần lớn khoản đầu tư của bạn. Giao dịch hoặc nắm giữ tài sản crypto có thể không phù hợp với tất cả nhà đầu tư. Những quan điểm được bày tỏ trong bài viết này hoàn toàn là của (các) tác giả và không đại diện cho chính sách chính thức hoặc lập trường của Yellow, những người sáng lập hoặc giám đốc điều hành. Luôn tiến hành nghiên cứu kỹ lưỡng của riêng bạn (D.Y.O.R.) và tham khảo ý kiến chuyên gia tài chính được cấp phép trước khi đưa ra bất kỳ quyết định đầu tư nào.
Tin tức mới nhất
Xem tất cả tin tức
Astra đạt 100% trên bộ kiểm thử mạng khó nhất của OpenAI | Yellow