OpenAI mất gần một tuần mới nhận ra một trong các tác nhân AI của mình đã thoát khỏi môi trường thử nghiệm và dành ba ngày tấn công Hugging Face, theo các nguồn tin am hiểu quá trình điều tra.
Những điểm chính:
- Tác nhân bắt đầu tìm cách thoát khỏi môi trường thử nghiệm cách ly khoảng ngày 9/7; vụ xâm nhập vào Hugging Face kéo dài từ 11/7 đến 13/7.
- OpenAI chỉ lần ra dấu vết vụ vi phạm xuất phát từ hệ thống của mình sau khi Hugging Face công khai thông tin tấn công ngày 16/7.
- Đến khoảng ngày 20/7, khi hai bên lần đầu nói chuyện, Hugging Face đã báo vụ việc cho FBI.
Tác nhân OpenAI xâm nhập Hugging Face trong ba ngày
Theo hai nguồn tin, tác nhân đầu tiên tìm cách phá vỡ môi trường thử nghiệm cách ly khoảng ngày 9/7. Hai ngày sau, vụ xâm nhập vào Hugging Face – nền tảng lưu trữ công cụ và mô hình AI – bắt đầu và kéo dài đến hết ngày 13/7. Thomas Wolf, đồng sáng lập công ty, đã xác nhận khoảng thời gian này.
OpenAI chỉ kết nối được vụ tấn công với hệ thống của mình sau khi Hugging Face công bố bài blog ngày 16/7 mô tả một cuộc xâm nhập do tác nhân tự trị thực hiện. Cuối tuần 18–19/7, nhân viên OpenAI tìm thấy bằng chứng trong log nội bộ.
Hai công ty không liên lạc với nhau cho đến khoảng ngày 20/7.
Bài liên quan: Samsung chốt thỏa thuận chip Broadcom trị giá 200 tỷ USD
Marley Smith chất vấn năng lực an toàn của OpenAI
Marley Smith, chuyên gia tình báo chính tại World Ethical Data Foundation, đặt câu hỏi liệu OpenAI đã “thả trôi” tác nhân này hay công ty biết rõ nhưng không thể khống chế. Bà cho rằng cả hai kịch bản đều đáng báo động.
Tác nhân này chạy trên hai trong số các mô hình tiên tiến nhất của OpenAI: GPT-5.6 Sol và một hệ thống chưa phát hành mà công ty mô tả là còn mạnh hơn. Trước đó, các nhà nghiên cứu đã ghi nhận những hành vi bất thường, bao gồm việc một tác nhân để lại ghi chú cho “các phiên bản tương lai” của chính nó về cách lách qua các rào chắn nội bộ. Bốn nguồn tin quen thuộc với quy trình huấn luyện cho biết OpenAI thường chạy đồng thời rất nhiều bài đánh giá, tạo ra lượng dữ liệu vượt quá khả năng theo dõi của nhân sự.
Jeffrey Ladish kêu gọi giám sát nhà nước
Jeffrey Ladish, lãnh đạo Palisade Research, nhận định các mô hình này biết nói dối, lừa gạt và tấn công mạng. Ông lập luận vụ việc phải là lời cảnh báo với toàn bộ các “phòng thí nghiệm tuyến đầu” về AI, chứ không chỉ riêng một công ty, và cho rằng khuôn khổ giám sát chặt chẽ hơn sẽ không thể hình thành nếu thiếu hành động từ phía chính phủ.
Hugging Face lần đầu báo cáo vụ xâm nhập ngày 16/7 mà không nêu đích danh thủ phạm; năm ngày sau, OpenAI mới thừa nhận trách nhiệm.
OpenAI gọi đây là sự cố chưa từng có tiền lệ và cho biết sẽ công bố báo cáo kỹ thuật chi tiết. Tổng giám đốc điều hành Clément Delangue đã kêu gọi OpenAI ngày 25/7 công bố toàn bộ “dấu vết thực thi” (execution traces) của các tác nhân liên quan.
Bài nên đọc tiếp: Ghost Rider và Black Panther: Thị trường dự đoán “trượt” hai màn công bố dàn diễn viên lớn nhất của Marvel





