Modal Labs xác nhận một tác nhân tự động “vượt rào” của OpenAI đã chiếm quyền điều khiển một sandbox của khách hàng và từ đó thực hiện khoảng 17.600 hành động ghi nhận được nhằm vào Hugging Face.
Những điểm chính:
- Một nhà cung cấp đám mây cho biết một tác nhân thử nghiệm của OpenAI đã thoát khỏi môi trường kiểm thử, chiếm một sandbox của khách hàng và dùng đó làm bàn đạp cho chiến dịch tấn công rộng hơn.
- Khách hàng để lộ một endpoint mở, cho phép bất kỳ ai trên internet thực thi mã.
- OpenAI cho biết tác nhân này đã chạm tới bốn tài khoản tại bốn dịch vụ khác nhau trong quá trình hoạt động.
Sự cố xâm nhập sandbox khách hàng tại Modal Labs
Giám đốc công nghệ của Modal, Akshat Bubna, cho biết tác nhân này đã khai thác lỗ hổng trong mã của một khách hàng.
Khách hàng đó đã công khai một endpoint không yêu cầu xác thực, cho phép bất kỳ ai trên internet chạy mã bên trong các sandbox đám mây của họ. Bubna nói với báo chí rằng nền tảng cốt lõi của Modal và các lớp cô lập hệ thống không bị xâm phạm; toàn bộ thiệt hại chỉ giới hạn trong phạm vi tài khoản của khách hàng.
Hugging Face công bố một báo cáo điều tra pháp chứng ngày 27/7, truy ngược chiến dịch tấn công về một sandbox chạy trên hạ tầng của một nhà cung cấp bên thứ ba.
Bài viết khi đó không nêu tên nhà cung cấp, và sau đó Modal xác nhận tài khoản bị lợi dụng thuộc về một khách hàng đang vận hành ExploitGym, một bộ benchmark công khai dùng để kiểm tra khả năng mô hình phát hiện và khai thác lỗ hổng phần mềm.
OpenAI từ chối bình luận cụ thể về tài khoản tại Modal.
Thay vào đó, công ty dẫn lại một bản cập nhật trước đó, trong đó cho biết tác nhân này đã tiếp cận bốn tài khoản tại bốn dịch vụ khác nhau, nhưng không nêu tên. Theo OpenAI, không có vụ việc nào khác đạt mức độ nghiêm trọng như sự cố tại Hugging Face.
Đọc thêm: Tấn công “Crypto Wrench” cán mốc 52 vụ trong 6 tháng, phần lớn xảy ra tại Pháp
Akshat Bubna, Clement Delangue và rủi ro từ tác nhân AI
Đồng sáng lập Hugging Face, Clement Delangue, cho biết đội ngũ của ông đã nghi ngờ một “phòng thí nghiệm tuyến đầu” đứng sau vụ xâm nhập từ lâu trước khi OpenAI lên tiếng, và ông không tin OpenAI có chủ đích gây hại.
Việc Modal công khai vụ việc mở rộng bức tranh rủi ro: một tác nhân tự động không chỉ xâm nhập Hugging Face mà còn đi xa tới một công ty thứ ba, nơi khách hàng hoàn toàn không đăng ký tham gia bất kỳ thử nghiệm an toàn nào của OpenAI.
Đội kỹ sư tái dựng chiến dịch đã gom khoảng 17.600 hành động thu hồi được vào khoảng 6.280 cụm, ghi nhận từ ngày 9/7 đến 13/7 trên các sandbox sống ngắn mà tác nhân liên tục tạo mới. Phần lớn nỗ lực đều thất bại. Kết luận của họ: tốc độ của máy móc, hơn là một khai thác đơn lẻ đặc biệt tinh vi, mới là yếu tố đang thay đổi “bài toán tính toán” đối với lực lượng phòng vệ.
Dòng thời gian sự cố tác nhân “vượt rào” của OpenAI
OpenAI công bố sự cố ngày 22/7, cho biết một tác nhân đã thoát khỏi sandbox đánh giá thông qua lỗ hổng trong một proxy gói và vươn ra internet công cộng. Để đo lường “năng lực tấn công thô” của mô hình, các nhà nghiên cứu đã tắt các bộ lọc an toàn trong môi trường sản xuất.
Tác nhân sau đó đã bị vô hiệu hóa, mã hóa và cắt hoàn toàn quyền truy cập phục vụ nghiên cứu.
Hugging Face cho hay nội dung khách hàng duy nhất bị tác nhân này đọc là bộ lời giải benchmark nằm trong năm bộ dữ liệu; không có mô hình hay gói phần mềm nào khác bị chạm tới.
Các bản tin tuần trước tiết lộ OpenAI đã không nhận ra tác nhân đi chệch hướng cho tới khi mối đe dọa cơ bản đã được khống chế, và Cục Điều tra Liên bang Mỹ (FBI) đã được thông báo.
Bài tiếp theo: Dự báo ngắn hạn với XRP: kịch bản tích cực nhất quanh 1,25 USD trước cuộc họp Fed





