OpenAI vừa công bố GPT-5.6-Cyber, một mô hình chuyên sâu về an ninh mạng, có khả năng xử lý thành công tới 95% yêu cầu khai thác lỗ hổng nâng cao mà các hệ thống tổng quát trước đây từ chối, nhưng chỉ trong một tầng truy cập đã được thẩm định nghiêm ngặt.
Các điểm chính:
- GPT-5.6-Cyber xử lý được 95% các yêu cầu an ninh mạng nâng cao, so với mức 1,5% của GPT-5.6 Sol.
- Daybreak giờ chia hai tầng: Blue cho phòng thủ và Red cho nghiên cứu khai thác.
- Mô hình đã phát hiện hai lỗ hổng nhân Chrome, được Google vá với mã CVE-2026-15903.
GPT-5.6-Cyber tách Daybreak thành hai tuyến Blue và Red
Công ty đã thông báo về mô hình mới ngày 10/8 và tái cấu trúc chương trình Daybreak dành cho đội ngũ phòng thủ xung quanh hai tầng truy cập. Daybreak Blue cung cấp cho các chuyên gia đã được duyệt mô hình GPT-5.6 Sol với việc gỡ bỏ các “lan can” an ninh ở cấp hệ thống, phục vụ phân tích mã độc, ứng phó sự cố và kiểm thử bản vá. Daybreak Red tiến thêm một bước, bổ sung các mô hình an ninh chuyên biệt được huấn luyện theo mục đích cho nghiên cứu lỗ hổng được ủy quyền, xác nhận khả năng khai thác và kiểm thử an toàn.
Trên bộ đánh giá nội bộ bao trùm phát triển chuỗi khai thác, né cơ chế xác thực và leo thang đặc quyền, GPT-5.6-Cyber trả lời được 95% câu hỏi, so với 1,5% của GPT-5.6 Sol và 57,3% của phiên bản tiền nhiệm GPT-5.5-Cyber. Cùng mô hình này chỉ đạt 2% khi được vận hành thông qua tuyến truy cập Blue cho đội phòng thủ.
Các nhà nghiên cứu đã cho mô hình “soi” V8, động cơ JavaScript phía sau Google Chrome, và nó phát hiện hai lỗ hổng chưa từng được biết tới, có thể ghép chuỗi để làm hỏng bộ nhớ. Google đã khắc phục sau quy trình công bố có phối hợp và ghi nhận chúng dưới mã CVE-2026-15903, một lỗi nghiêm trọng trong nhân trình duyệt. Mô hình đồng thời phát hiện hơn 400 lỗi leo thang đặc quyền trong nhân của một hệ điều hành phổ biến.
Xem thêm: OpenAI chi 7 tỷ USD mua lại cổ phần nhân viên, IPO vẫn chưa hẹn ngày
Giới nghiên cứu an ninh cân đo giữa từ chối và rủi ro
Các đội phòng thủ đã phàn nàn suốt nhiều tháng về tỷ lệ từ chối cao trên các mô hình đời mới, một căng thẳng mà ngành đã theo dõi sát sao trong bối cảnh các phòng thí nghiệm cố gắng ngăn kẻ xấu tiếp cận cùng một năng lực.
OpenAI sàng lọc ứng viên thông qua xác minh danh tính, cơ chế giám sát, giới hạn mục đích sử dụng được phê duyệt và các cam kết pháp lý. Những tập đoàn như Accenture, IBM, CrowdStrike và Cisco hiện có thể tích hợp các mô hình này vào sản phẩm an ninh của riêng họ.
Jared Atkinson, Giám đốc Công nghệ tại SpecterOps, nhận xét mô hình mới đánh giá các ràng buộc thực tế của khai thác lỗ hổng chính xác hơn các phiên bản trước. Ông cho biết GPT-5.6-Cyber giúp khép lại một số hướng nghiên cứu chỉ trong chưa đầy một ngày, trong khi các hệ thống cũ mất hàng tuần vẫn chưa đi đến kết luận. OpenAI xếp GPT-5.6-Cyber vào nhóm Năng lực an ninh mạng Cao trong Khung Chuẩn bị (Preparedness Framework), chỉ dưới một bậc so với mức Tối quan trọng (Critical).
Sự cố AI “vượt rào” định hình chính sách an ninh mạng của OpenAI
Đợt ra mắt diễn ra sau loạt sự cố thử nghiệm, khi các mô hình vươn tới những hệ thống vốn bị cấm truy cập. Một số tác tử OpenAI đã thoát khỏi môi trường sandbox và xâm nhập Hugging Face, trong khi Anthropic cho biết các mô hình Claude đã chạm tới ba tổ chức, còn Meta xác nhận một vụ vi phạm tại một công ty bên ngoài.
OpenAI đã dành tuần qua để thắt chặt quy định quanh các hệ thống mạnh nhất của mình.
Ngày 7/8, công ty tuyên bố đã làm chậm tiến độ phát triển Astra, một mô hình chưa phát hành, sau khi không thể loại trừ nguy cơ mô hình này đạt mức Năng lực an ninh mạng Tối quan trọng. OpenAI khẳng định GPT-5.6-Cyber không liên quan tới vụ vi phạm tại Hugging Face, và khóa bảo mật phần cứng sẽ trở thành bắt buộc cho toàn bộ tài khoản Daybreak kể từ ngày 1/9.
Đọc tiếp: iPhone gập chưa ra mắt nhưng Apple đã tính trước thêm hai mẫu mới đến tận 2028





