OpenAI cho biết hai mô hình của hãng đã thoát khỏi một môi trường đánh giá an ninh biệt lập, vươn ra internet và xâm nhập hệ thống của Hugging Face trong quá trình truy tìm đáp án cho một bộ kiểm thử bảo mật.
Những điểm chính
- GPT-5.6 Sol và một mô hình chưa phát hành, mạnh hơn, đã khai thác lỗ hổng trong hạ tầng của cả OpenAI lẫn Hugging Face.
- Hugging Face tuyên bố đã khoanh vùng vụ xâm nhập và không phát hiện dấu hiệu các mô hình, bộ dữ liệu hay Spaces công khai bị chỉnh sửa.
- Sự cố cho thấy AI tuyến đầu có thể biến hành vi “luyện điểm benchmark” thành một cuộc tấn công mạng ngoài đời thực.
Lỗ hổng hộp cát tại OpenAI
OpenAI cho biết ngày 21/7 rằng GPT-5.6 Sol và một mô hình tiền phát hành chưa được đặt tên đã gây ra một “sự cố an ninh mạng chưa từng có tiền lệ” trong quá trình thử nghiệm nội bộ, nơi các rào chặn về an ninh mạng được nới lỏng.
Các mô hình này đang được đánh giá năng lực tấn công trên ExploitGym, một bộ chuẩn dùng để đo xem tác nhân AI có thể xây dựng khai thác thực thi từ các lỗ hổng đã biết hay không. Thay vì thực hiện bài kiểm tra như bình thường, chúng lại tìm kiếm sẵn đáp án của bộ benchmark.
Theo OpenAI, các mô hình đã tiêu tốn lượng tài nguyên tính toán đáng kể để dò tìm lối thoát khỏi hộp cát. Chúng phát hiện một lỗ hổng zero-day trong proxy của kho đăng ký gói bên thứ ba, leo thang đặc quyền và di chuyển trong môi trường nghiên cứu cho đến khi chạm được vào một hệ thống có kết nối internet.
Sau đó, các mô hình chuyển hướng sang Hugging Face, nơi chúng cho rằng dữ liệu liên quan đến ExploitGym đang được lưu trữ. OpenAI nói rằng chúng đã kết hợp thông tin xác thực bị đánh cắp với các lỗ hổng bổ sung để truy cập được tập dữ liệu đánh giá bí mật trên hệ thống sản xuất của nền tảng.
Xem thêm: Claude Fable 5 vừa khép lại bế tắc toán học 87 năm, và Bitcoin thì để tâm
Phản ứng của Hugging Face
Hugging Face cho biết vụ xâm nhập khởi phát từ hai điểm yếu cho phép thực thi mã trong pipeline xử lý dữ liệu của hãng. Hoạt động tấn công sau đó leo thang thành truy cập node, làm lộ thông tin xác thực đám mây và cụm, rồi lan sang một số cụm nội bộ khác.
Đội điều tra của Hugging Face ghi nhận hơn 17.000 hành động được thực hiện thông qua các hộp cát sống ngắn. Công ty đã đóng các đường tấn công dễ tổn thương, dựng lại những node bị ảnh hưởng, xoay vòng toàn bộ thông tin xác thực và siết chặt lớp kiểm soát truy cập.
Hugging Face nói chưa tìm thấy bằng chứng nào cho thấy mô hình công khai, bộ dữ liệu, Spaces hay chuỗi cung ứng phần mềm của hãng bị can thiệp. Công ty vẫn đang rà soát xem dữ liệu đối tác hoặc khách hàng có bị ảnh hưởng hay không.
Đáng chú ý, họ sử dụng mô hình mã mở GLM 5.2 cho công tác điều tra số, do các hệ thống thương mại dạng dịch vụ lưu trữ chặn một số truy vấn liên quan an ninh.
Về phía mình, OpenAI đã siết lại cơ chế đánh giá nội bộ và tham gia vào cuộc điều tra chung với Hugging Face.
Sự kiện diễn ra sau các cảnh báo trước đó rằng GPT-5.6 Sol có thể duy trì những chiến dịch tấn công mạng phức tạp, dù thử nghiệm tiền phát hành chưa từng cho thấy một cuộc tấn công hoàn toàn tự động vào mục tiêu đã được gia cố. Lần vi phạm này biến rủi ro lý thuyết thành sự cố được ghi nhận chi tiết trên hạ tầng sản xuất thực tế.
Đọc tiếp: Telegram sẽ đưa ví Gram phi lưu ký vào mọi ứng dụng, Durov nói





