OpenAI cho biết Astra có thể tiến sát ngưỡng an ninh mạng Cấp Nguy Cấp sau khi phiên bản chưa phát hành của mô hình này tạo ra 10 kết quả toán học đột phá và thể hiện tốc độ cải thiện nhanh trong công việc an ninh mạng mang tính tự động.
Các ý chính:
- Ngày 7/8, OpenAI nói họ không thể loại trừ khả năng Astra đạt năng lực an ninh mạng cấp Nguy Cấp.
- Công ty tạm dừng một số hoạt động nội bộ với Astra, đồng thời siết chặt kiểm soát bảo mật, sandbox và giám sát.
- Astra cũng tạo ra 10 kết quả nghiên cứu giải quyết hoặc đẩy mạnh tiến triển các bài toán lâu năm trong toán học và khoa học máy tính lý thuyết.
Rủi ro an ninh mạng từ Astra
Ngày 7/8, OpenAI cho hay các đánh giá nội bộ gần đây cho thấy tiến bộ lớn về khả năng lập trình tác vụ (agentic coding) và an ninh mạng – đủ để họ không còn có thể loại trừ kịch bản Astra chạm mức Nguy Cấp theo Khung Chuẩn Bị (Preparedness Framework) của công ty. OpenAI không khẳng định mô hình đã đạt ngưỡng này; đánh giá hiện vẫn là sơ bộ.
Theo khung này, một mô hình Cấp Nguy Cấp có thể tự động phát triển các khai thác zero-day hoàn chỉnh trên nhiều hệ thống trọng yếu đã được gia cố, hoặc tự thiết kế và thực thi các chuỗi tấn công hoàn toàn mới chỉ từ một mục tiêu cấp cao. OpenAI cho biết họ đang siết chặt quyền truy cập mạng và công cụ, bảo vệ trọng số mô hình, mã hóa và sandbox, đồng thời mở rộng giám sát với các cách sử dụng Astra mang tính tác vụ.
Công ty cũng tạm dừng những hoạt động liên quan Astra chưa đáp ứng được lớp kiểm soát mới, và cho biết sẽ phối hợp cơ quan quản lý cùng một số tổ chức an toàn AI trong quá trình thử nghiệm. Ngày 1/8, OpenAI mô tả Astra là “mô hình lớn tiếp theo của chúng tôi”. Đến 7/8, họ điều chỉnh cách gọi Astra thành “một trong những mô hình sắp ra mắt”.
Xem thêm: Bitcoin tiến gần nhánh BIP-110 cuối tuần này khi chỉ có 2,59% thợ đào ủng hộ
Tranh luận quanh các kết quả toán học
Cảnh báo an ninh được đưa ra sau khi OpenAI tiết lộ một phiên bản nội bộ của Astra đã tạo ra 10 kết quả trải rộng các lĩnh vực như độ phức tạp lượng tử, mật mã học lattice, lý thuyết mã hóa và tổ hợp cực hạn. OpenAI nói những kết quả này đã giải quyết hoặc đẩy mạnh đáng kể tiến triển các bài toán mở tồn tại lâu năm, với chi phí khoảng 2.000 USD tiền token theo biểu giá API Sol.
Andrew Blumberg, giáo sư tại Columbia và là thành viên hội đồng First Proof, nói với Mashable rằng các kết quả rất ấn tượng nhưng không làm thay đổi đánh giá của ông về khả năng hiện tại của AI. Ông cho biết phần lớn là các phản ví dụ ngắn gọn hoặc “những cấu trúc rất nhỏ nhưng cực kỳ tinh vi” được xây dựng trên nền các công trình đã biết. “Chúng không làm tôi thay đổi niềm tin ban đầu,” ông nói.
Dù vậy, các kết quả này cho thấy các mô hình tuyến đầu có thể trở thành cộng sự nghiên cứu hữu ích – trong khi đồng thời tạo ra một bài toán an ninh song song khi cùng năng lực lập trình đó có thể được chuyển sang khai thác phần mềm.
Sự căng thẳng này đang định hình lại cách OpenAI đánh giá quyền truy cập và triển khai mô hình.
Trước Astra, OpenAI đánh giá GPT-5.6 Sol ở mức an ninh mạng Cao (High), chứ chưa đến Nguy Cấp. Mô hình trước đó có thể hỗ trợ tìm kiếm lỗ hổng và khai thác, nhưng theo OpenAI, nó chưa thể tiến hành các cuộc tấn công tự động, đáng tin cậy vào mục tiêu đã được gia cố – khiến đánh giá mới dành cho Astra trở thành một bước leo thang đáng chú ý.
Đọc tiếp: Ngày ra mắt iPhone Fold được đồn rơi vào 18/9, nhưng còn nhiều ý kiến trái chiều





