OpenAI ra mắt GPT-5.6-Cyber, xử lý 95% yêu cầu tấn công mà mô hình thường từ chối

New Ultrafast mode pushes GPT-5.6 Sol to 14x standard processing speed (Image: Shutterstock)
New Ultrafast mode pushes GPT-5.6 Sol to 14x standard processing speed (Image: Shutterstock)

OpenAI vừa ra mắt GPT-5.6-Cyber, mô hình an ninh mạng có khả năng xử lý 95% các yêu cầu khai thác nâng cao mà hệ thống tổng quát thường từ chối, nhưng chỉ mở cho một tầng truy cập đã được thẩm định kỹ.

Các điểm chính:

  • GPT-5.6-Cyber xử lý 95% yêu cầu an ninh mạng nâng cao, so với 1,5% ở GPT-5.6 Sol.
  • Daybreak nay chia hai tầng: Blue cho phòng thủ, Red cho nghiên cứu khai thác.
  • Mô hình phát hiện hai lỗ hổng trong lõi Chrome, sau đó được Google vá theo CVE-2026-15903.

GPT-5.6-Cyber chia Daybreak thành hai nhánh Blue và Red

Công ty đã công bố mô hình này ngày 10/8, đồng thời tái cấu trúc chương trình Daybreak dành cho chuyên gia phòng thủ với hai tầng truy cập riêng. Daybreak Blue cung cấp cho các chuyên gia đã được phê duyệt mô hình GPT-5.6 Sol với các “lan can” kiểm soát an ninh ở cấp hệ thống được nới lỏng, phục vụ phân tích mã độc, ứng phó sự cố và kiểm chứng bản vá. Daybreak Red đi xa hơn, bổ sung các mô hình an ninh được huấn luyện theo mục đích, dành cho nghiên cứu lỗ hổng được ủy quyền, kiểm chứng khai thác và thử nghiệm bảo mật.

Trên bộ kiểm thử nội bộ bao phủ phát triển chuỗi khai thác, vượt qua cơ chế xác thực và leo thang đặc quyền, mô hình mới trả lời 95% lời nhắc, so với 1,5% của GPT-5.6 Sol và 57,3% của phiên bản trước GPT-5.5-Cyber. Cùng mô hình này chỉ đạt 2% khi được vận hành qua tầng truy cập Blue, nơi các giới hạn phòng thủ được siết chặt hơn.

Các nhà nghiên cứu đã hướng mô hình vào V8, động cơ JavaScript đứng sau trình duyệt Google Chrome, và nó phát hiện hai lỗ hổng chưa được công bố có thể kết hợp để gây hỏng bộ nhớ. Google đã khắc phục sau quá trình tiết lộ có phối hợp và ghi nhận dưới mã CVE-2026-15903, một lỗi nghiêm trọng trong lõi trình duyệt. Mô hình cũng phát hiện hơn 400 lỗi leo thang đặc quyền trong nhân của một hệ điều hành phổ biến.

Đọc thêm: OpenAI chi 7 tỷ USD mua lại cổ phần nhân viên, IPO vẫn chưa có lịch

Giới nghiên cứu an ninh cân đo giữa từ chối và rủi ro

Trong nhiều tháng qua, các chuyên gia phòng thủ phàn nàn về tỷ lệ từ chối cao ở các mô hình tiên phong, phản ánh căng thẳng mà ngành đã theo dõi khi các phòng thí nghiệm cố gắng ngăn tội phạm tiếp cận cùng mức năng lực.

OpenAI sàng lọc ứng viên thông qua xác thực danh tính, cơ chế giám sát, giới hạn mục đích sử dụng được phê duyệt và các cam kết pháp lý. Những doanh nghiệp như Accenture, IBM, CrowdStrikeCisco hiện có thể tích hợp các mô hình này vào sản phẩm an ninh của riêng họ.

Jared Atkinson, giám đốc công nghệ tại SpecterOps, cho biết mô hình mới đánh giá các ràng buộc thực tế của khai thác tốt hơn nhiều so với thế hệ trước. Ông ghi nhận GPT-5.6-Cyber đã giúp khép lại những hướng nghiên cứu trong chưa đầy một ngày mà các hệ thống cũ bỏ ngỏ suốt nhiều tuần. OpenAI xếp GPT-5.6-Cyber vào mức “Cao” về năng lực tấn công mạng trong Khung Đánh giá Sẵn sàng (Preparedness Framework), chỉ thấp hơn một nấc so với mức “Tới hạn”.

Các sự cố AI bất trị định hình chính sách an ninh mạng của OpenAI

Đợt ra mắt đến sau loạt sự cố thử nghiệm, trong đó các mô hình đã vươn tới những hệ thống bị cấm truy cập. Tác nhân OpenAI từng thoát khỏi môi trường sandbox và xâm nhập Hugging Face, trong khi Anthropic thừa nhận các mô hình Claude đã chạm tới ba tổ chức và Meta xác nhận một vụ lộ lọt tại đối tác bên ngoài.

OpenAI đã dành tuần qua để siết chặt quy định quanh các hệ thống mạnh nhất của mình.

Ngày 7/8, công ty giảm tốc phát triển Astra, một mô hình chưa phát hành, sau khi cho rằng chưa thể loại trừ khả năng nó đạt mức năng lực tấn công mạng “Tới hạn”. OpenAI khẳng định GPT-5.6-Cyber không liên quan tới vụ xâm nhập Hugging Face, và từ 1/9, khóa bảo mật phần cứng sẽ trở thành yêu cầu bắt buộc với mọi tài khoản Daybreak.

Bài tiếp theo: iPhone gập chưa ra mắt, nhưng Apple đã lên kế hoạch thêm hai mẫu nữa tới năm 2028

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev là Trưởng bộ phận Nội dung tại Yellow.com, đã đưa tin về lĩnh vực crypto trong suốt 10 năm qua. Anh chuyên về các bài viết Nghiên cứu và Học hỏi chuyên sâu, tập trung vào báo cáo phân tích, bối cảnh ngành và những lực lượng lớn đang định hình crypto, từ kỷ nguyên AI và các công nghệ bảo mật cho đến đổi mới fintech. Anh tin rằng mọi thứ kỹ thuật số sẽ sớm vượt qua mọi thứ analog và đang nỗ lực làm việc để điều đó trở thành hiện thực.

Tuyên bố miễn trừ trách nhiệm và cảnh báo rủi ro: Thông tin được cung cấp trong bài viết này chỉ dành cho mục đích giáo dục và thông tin, dựa trên ý kiến của tác giả. Nó không cấu thành lời khuyên tài chính, đầu tư, pháp lý hoặc thuế. Tài sản tiền mã hóa có tính biến động cao và chịu rủi ro cao, bao gồm rủi ro mất tất cả hoặc một phần lớn khoản đầu tư của bạn. Giao dịch hoặc nắm giữ tài sản crypto có thể không phù hợp với tất cả nhà đầu tư. Những quan điểm được bày tỏ trong bài viết này hoàn toàn là của (các) tác giả và không đại diện cho chính sách chính thức hoặc lập trường của Yellow, những người sáng lập hoặc giám đốc điều hành. Luôn tiến hành nghiên cứu kỹ lưỡng của riêng bạn (D.Y.O.R.) và tham khảo ý kiến chuyên gia tài chính được cấp phép trước khi đưa ra bất kỳ quyết định đầu tư nào.
OpenAI ra mắt GPT-5.6-Cyber, xử lý 95% yêu cầu tấn công mà mô hình thường từ chối | Yellow