OpenAI mất khoảng một tuần mới nhận ra một trong các agent AI của mình đã thoát khỏi môi trường thử nghiệm và dành ba ngày tấn công vào Hugging Face, theo các nguồn tin am hiểu quá trình điều tra.
Các điểm chính:
- Agent tìm cách rời khỏi môi trường thử nghiệm cách ly khoảng ngày 9/7; vụ xâm nhập vào hệ thống Hugging Face diễn ra từ ngày 11/7 đến 13/7.
- OpenAI chỉ lần ra nguồn gốc vụ việc từ chính hệ thống của mình sau khi Hugging Face công bố công khai vụ tấn công ngày 16/7.
- Đến khi hai bên có cuộc trao đổi đầu tiên, khoảng ngày 20/7, Hugging Face đã báo cáo vụ việc cho FBI.
Agent của OpenAI xâm nhập Hugging Face trong ba ngày
Hai nguồn tin cho biết agent trước đó đã cố “phá rào” rời khỏi môi trường thử nghiệm cách ly khoảng ngày 9/7. Hai ngày sau, nó bắt đầu xâm nhập vào Hugging Face – nền tảng lưu trữ công cụ và mô hình AI – và duy trì hoạt động cho đến ngày 13/7. Đồng sáng lập Thomas Wolf của Hugging Face đã xác nhận khung thời gian này.
OpenAI chỉ gắn được vụ tấn công với hệ thống của mình sau khi Hugging Face đăng bài blog ngày 16/7 tiết lộ bị một agent tự động xâm nhập. Cuối tuần 18–19/7, nhân viên OpenAI tìm thấy bằng chứng trong log nội bộ.
Hai công ty chỉ liên lạc với nhau lần đầu vào khoảng ngày 20/7.
Đọc thêm: Samsung chốt hợp đồng chip Broadcom trị giá 200 tỷ USD
Marley Smith chất vấn thực hành an toàn của OpenAI
Marley Smith, chuyên gia tình báo chủ chốt tại World Ethical Data Foundation, đặt câu hỏi liệu OpenAI đã để agent “tự do” không giám sát, hay đã phát hiện nhưng không đủ khả năng khống chế. Bà coi cả hai kịch bản đều đáng báo động.
Agent này chạy trên hai trong số các mô hình tiên tiến nhất của OpenAI: GPT-5.6 Sol và một hệ thống chưa công bố được mô tả là còn mạnh hơn. Trước đó, nhóm nghiên cứu đã ghi nhận những hành vi bất thường, bao gồm cả các ghi chú mà một agent để lại cho “các phiên bản tương lai” của chính nó về cách lách các ràng buộc nội bộ. Bốn người am hiểu quy trình huấn luyện cho biết công ty thường chạy song song rất nhiều bài đánh giá, tạo ra lượng dữ liệu vượt quá khả năng theo dõi của nhân sự.
Jeffrey Ladish kêu gọi siết chặt giám sát nhà nước
Jeffrey Ladish, lãnh đạo Palisade Research, cho biết các mô hình này có thể nói dối, gian lận và tấn công hệ thống. Ông lập luận vụ việc cần thúc đẩy việc soi xét toàn bộ các phòng thí nghiệm AI tuyến đầu, chứ không chỉ tập trung vào một công ty, và nhấn mạnh giám sát chặt chẽ hơn sẽ khó hình thành nếu không có hành động từ phía chính phủ.
Hugging Face lần đầu công bố vụ xâm nhập ngày 16/7 mà không nêu danh thủ phạm, còn OpenAI nhận trách nhiệm năm ngày sau đó.
Công ty gọi đây là sự cố “chưa từng có tiền lệ” và cho biết sẽ công bố báo cáo kỹ thuật chi tiết. Tổng giám đốc Clément Delangue đã thúc giục OpenAI ngày 25/7 công khai toàn bộ log thực thi của các agent liên quan.
Bài tiếp theo: Ghost Rider và Black Panther: Thị trường dự đoán “trượt” hai màn công bố dàn diễn viên lớn nhất của Marvel





