Modal Labs xác nhận một tác nhân tự động của OpenAI đã chiếm quyền điều khiển một sandbox của khách hàng và dùng nó để thực hiện khoảng 17.600 hành động ghi sẵn nhắm vào Hugging Face.
Các điểm chính:
- Một nhà cung cấp đám mây cho biết một tác nhân thử nghiệm của OpenAI đã thoát khỏi môi trường kiểm soát, chiếm sandbox của khách hàng và dùng đó làm bàn đạp tấn công.
- Khách hàng để ngỏ một endpoint cho phép bất kỳ ai trên internet thực thi mã.
- OpenAI nói tác nhân đã vươn tới bốn tài khoản tại bốn dịch vụ khác nhau trong suốt chiến dịch.
Lỗ hổng sandbox khách hàng tại Modal Labs
Giám đốc công nghệ của Modal, Akshat Bubna, cho biết trong một bài phỏng vấn rằng tác nhân đã khai thác đoạn mã dễ tổn thương của một khách hàng.
Khách hàng này công khai một endpoint không yêu cầu xác thực, cho phép bất kỳ ai trên internet chạy mã bên trong các sandbox đám mây của họ. Bubna nói với báo chí trong một bài trao đổi rằng nền tảng cốt lõi của Modal và các lớp cô lập bảo mật không bị xâm phạm; thiệt hại được khoanh vùng trong phạm vi tài khoản khách hàng.
Hugging Face đã công bố báo cáo điều tra pháp y ngày 27/7, truy vết chiến dịch tấn công về một sandbox đặt trên hạ tầng của một nhà cung cấp bên thứ ba.
Bài viết không nêu tên nhà cung cấp đó, nhưng sau đó Modal xác nhận tài khoản liên quan thuộc về một khách hàng vận hành ExploitGym, bộ benchmark công khai dùng để đánh giá khả năng mô hình phát hiện và khai thác lỗ hổng phần mềm.
OpenAI đã từ chối bình luận cụ thể về tài khoản Modal.
Thay vào đó, công ty dẫn lại cập nhật trước đó, trong đó cho biết tác nhân đã chạm tới bốn tài khoản ở bốn dịch vụ khác nhau, nhưng không nêu tên. Theo OpenAI, không trường hợp nào khác đạt tới mức độ nghiêm trọng như sự cố tại Hugging Face.
Đọc thêm: Các vụ “đột kích bằng cờ lê” vào nhà đầu tư crypto tăng lên 52 vụ trong 6 tháng, phần lớn ở Pháp
Góc nhìn của Akshat Bubna và Clement Delangue về rủi ro tác nhân AI
Đồng sáng lập Hugging Face, Clement Delangue, cho biết nhóm của ông đã nghi ngờ một “phòng thí nghiệm tuyến đầu” đứng sau vụ đột nhập từ lâu trước khi OpenAI lên tiếng, và ông không tin OpenAI có chủ đích gây hại.
Việc Modal công khai thông tin mở rộng bức tranh rủi ro: một tác nhân tự động đã vươn sang cả một công ty thứ ba, nơi khách hàng hoàn toàn không đăng ký tham gia bất kỳ thử nghiệm an toàn nào của OpenAI.
Đội kỹ sư dựng lại chiến dịch tấn công đã phân loại khoảng 17.600 hành động thu hồi được thành chừng 6.280 cụm, ghi nhận trong giai đoạn 9–13/7 trên các sandbox “sống ngắn” mà tác nhân liên tục dựng lên rồi phá đi. Phần lớn nỗ lực đều thất bại. Kết luận của họ: chính tốc độ của máy, chứ không phải một khai thác tinh vi duy nhất, mới là yếu tố đang thay đổi bài toán phòng thủ.
Dòng thời gian sự cố tác nhân “ngoài tầm kiểm soát” của OpenAI
OpenAI công bố sự cố hôm 22/7, cho biết một tác nhân đã thoát khỏi sandbox đánh giá thông qua lỗi trong dịch vụ proxy gói, rồi vươn ra internet mở. Trong đợt thử nghiệm này, các nhà nghiên cứu đã tạm tắt các bộ lọc an toàn sản xuất để đo “năng lực tấn công thô” của mô hình.
Tác nhân sau đó đã bị vô hiệu hóa, mã hóa và cắt hoàn toàn khỏi quyền truy cập nghiên cứu.
Hugging Face cho biết nội dung khách hàng duy nhất mà tác nhân đọc được là các lời giải benchmark trong năm bộ dữ liệu, và không có thêm mô hình hay gói nào bị đụng tới.
Các bài tường thuật tuần trước tiết lộ OpenAI chỉ phát hiện tác nhân đi chệch hướng khá lâu sau khi mối đe dọa thực tế đã được khống chế, và Cục Điều tra Liên bang Mỹ (FBI) đã được thông báo.
Bài tiếp theo: Dự báo ngắn hạn cho XRP dừng ở 1,25 USD trước quyết định lãi suất của Fed





