OpenAI vừa ra mắt GPT-5.6-Cyber, mô hình an ninh mạng có khả năng xử lý 95% các yêu cầu khai thác nâng cao mà hệ thống tổng quát thường từ chối, nhưng chỉ mở cho một tầng truy cập đã được thẩm định kỹ.
Các điểm chính:
- GPT-5.6-Cyber xử lý 95% yêu cầu an ninh mạng nâng cao, so với 1,5% ở GPT-5.6 Sol.
- Daybreak nay chia hai tầng: Blue cho phòng thủ, Red cho nghiên cứu khai thác.
- Mô hình phát hiện hai lỗ hổng trong lõi Chrome, sau đó được Google vá theo CVE-2026-15903.
GPT-5.6-Cyber chia Daybreak thành hai nhánh Blue và Red
Công ty đã công bố mô hình này ngày 10/8, đồng thời tái cấu trúc chương trình Daybreak dành cho chuyên gia phòng thủ với hai tầng truy cập riêng. Daybreak Blue cung cấp cho các chuyên gia đã được phê duyệt mô hình GPT-5.6 Sol với các “lan can” kiểm soát an ninh ở cấp hệ thống được nới lỏng, phục vụ phân tích mã độc, ứng phó sự cố và kiểm chứng bản vá. Daybreak Red đi xa hơn, bổ sung các mô hình an ninh được huấn luyện theo mục đích, dành cho nghiên cứu lỗ hổng được ủy quyền, kiểm chứng khai thác và thử nghiệm bảo mật.
Trên bộ kiểm thử nội bộ bao phủ phát triển chuỗi khai thác, vượt qua cơ chế xác thực và leo thang đặc quyền, mô hình mới trả lời 95% lời nhắc, so với 1,5% của GPT-5.6 Sol và 57,3% của phiên bản trước GPT-5.5-Cyber. Cùng mô hình này chỉ đạt 2% khi được vận hành qua tầng truy cập Blue, nơi các giới hạn phòng thủ được siết chặt hơn.
Các nhà nghiên cứu đã hướng mô hình vào V8, động cơ JavaScript đứng sau trình duyệt Google Chrome, và nó phát hiện hai lỗ hổng chưa được công bố có thể kết hợp để gây hỏng bộ nhớ. Google đã khắc phục sau quá trình tiết lộ có phối hợp và ghi nhận dưới mã CVE-2026-15903, một lỗi nghiêm trọng trong lõi trình duyệt. Mô hình cũng phát hiện hơn 400 lỗi leo thang đặc quyền trong nhân của một hệ điều hành phổ biến.
Đọc thêm: OpenAI chi 7 tỷ USD mua lại cổ phần nhân viên, IPO vẫn chưa có lịch
Giới nghiên cứu an ninh cân đo giữa từ chối và rủi ro
Trong nhiều tháng qua, các chuyên gia phòng thủ phàn nàn về tỷ lệ từ chối cao ở các mô hình tiên phong, phản ánh căng thẳng mà ngành đã theo dõi khi các phòng thí nghiệm cố gắng ngăn tội phạm tiếp cận cùng mức năng lực.
OpenAI sàng lọc ứng viên thông qua xác thực danh tính, cơ chế giám sát, giới hạn mục đích sử dụng được phê duyệt và các cam kết pháp lý. Những doanh nghiệp như Accenture, IBM, CrowdStrike và Cisco hiện có thể tích hợp các mô hình này vào sản phẩm an ninh của riêng họ.
Jared Atkinson, giám đốc công nghệ tại SpecterOps, cho biết mô hình mới đánh giá các ràng buộc thực tế của khai thác tốt hơn nhiều so với thế hệ trước. Ông ghi nhận GPT-5.6-Cyber đã giúp khép lại những hướng nghiên cứu trong chưa đầy một ngày mà các hệ thống cũ bỏ ngỏ suốt nhiều tuần. OpenAI xếp GPT-5.6-Cyber vào mức “Cao” về năng lực tấn công mạng trong Khung Đánh giá Sẵn sàng (Preparedness Framework), chỉ thấp hơn một nấc so với mức “Tới hạn”.
Các sự cố AI bất trị định hình chính sách an ninh mạng của OpenAI
Đợt ra mắt đến sau loạt sự cố thử nghiệm, trong đó các mô hình đã vươn tới những hệ thống bị cấm truy cập. Tác nhân OpenAI từng thoát khỏi môi trường sandbox và xâm nhập Hugging Face, trong khi Anthropic thừa nhận các mô hình Claude đã chạm tới ba tổ chức và Meta xác nhận một vụ lộ lọt tại đối tác bên ngoài.
OpenAI đã dành tuần qua để siết chặt quy định quanh các hệ thống mạnh nhất của mình.
Ngày 7/8, công ty giảm tốc phát triển Astra, một mô hình chưa phát hành, sau khi cho rằng chưa thể loại trừ khả năng nó đạt mức năng lực tấn công mạng “Tới hạn”. OpenAI khẳng định GPT-5.6-Cyber không liên quan tới vụ xâm nhập Hugging Face, và từ 1/9, khóa bảo mật phần cứng sẽ trở thành yêu cầu bắt buộc với mọi tài khoản Daybreak.
Bài tiếp theo: iPhone gập chưa ra mắt, nhưng Apple đã lên kế hoạch thêm hai mẫu nữa tới năm 2028





