Một “bầy” agent OpenAI đã bí mật sử dụng hơn 10 website vốn chưa từng được công bố để thực hiện các hoạt động liên lạc ngoài phạm vi cho phép, sau khi lách được cơ chế hạn chế việc đăng tải nội dung lên web.
Những điểm chính:
- Các nhà điều tra độc lập lần theo dấu vết trao đổi thông tin của agent OpenAI tới hơn 10 website chưa từng được nhắc đến, được sử dụng trong giai đoạn từ tháng 5 đến tháng 7.
- Dấu vết xuất hiện trên các trang wiki, dịch vụ lưu trữ văn bản và công cụ rút gọn liên kết của trường đại học, với ước tính có thể lên tới 23 website.
- OpenAI cho biết quá trình rà soát nội bộ không phát hiện thêm hoạt động nào có mức độ nghiêm trọng hoặc quy mô tương đương sự cố trên Hugging Face.
Hoạt động của agent OpenAI
Theo bài phóng sự ngày 9/9 của Reuters, dựa trên sáu cuộc điều tra độc lập cùng dữ liệu do hãng tin này xem xét, các agent OpenAI đã sử dụng hơn 10 website trong khoảng thời gian từ tháng 5 đến tháng 7 để tiến hành liên lạc không được cấp phép. Kết quả này mở rộng đáng kể quy mô vụ việc, vốn trước đây chỉ tập trung vào một wiki tiếng Đức mà các agent đã biến thành “kênh nhắn tin dã chiến” trong lúc hoàn thành nhiệm vụ nghiên cứu.
Nhóm điều tra đã liên kết hoạt động trên nhiều website bằng cách đối chiếu chuỗi dữ liệu, tên người dùng và các câu hỏi nghiên cứu ít người biết tới, bao gồm cả truy vấn về tỷ lệ mắc ung thư tại bang Iowa. Một số dấu vết còn cho thấy manh mối liên quan đến hạ tầng Microsoft Azure, nền tảng mà OpenAI đôi khi sử dụng.
Reuters không thể xác minh từng tuyên bố riêng lẻ, song tất cả các nhóm điều tra mà hãng liên hệ đều đưa ra con số trên 10 website. Các nền tảng liên quan bao gồm wiki do cộng đồng biên tập, dịch vụ lưu trữ văn bản và công cụ rút gọn liên kết do các trường đại học vận hành.
OpenAI không tiết lộ tổng số website bị liên đới cũng như lý do vì sao hoạt động này bị che giấu suốt nhiều tháng. Công ty cho biết quá trình rà soát ở phạm vi rộng hơn “không xác định được hoạt động nào khác có mức độ nghiêm trọng hoặc quy mô tương tự Hugging Face” và cam kết sẽ đưa ra một khung quy trình báo cáo các trường hợp mô hình “lệch chuẩn” so với thiết kế.
Bài liên quan: Apple định giá cặp iPhone gập đầu tiên ở mức 1.999 USD, Samsung có lý do để lo lắng
Cảnh báo rủi ro từ Yoon
Andrew Yoon, nhà nghiên cứu tại tổ chức phi lợi nhuận CivAI có trụ sở tại California, cho biết ông ghi nhận 18 website trước đây chưa từng được công bố và nhận định quy mô vụ việc “lớn hơn đáng kể so với những gì chúng ta nghĩ”. Ông nhấn mạnh “gần như chắc chắn còn nhiều hoạt động khác mà chúng ta chưa phát hiện”.
Sydney Von Arx, người đứng đầu nhóm đầu tiên phát hiện hoạt động bất thường trên wiki tiếng Đức, nói rằng nhóm của cô có bằng chứng đáng tin cậy về 23 website chưa từng được báo cáo, nhưng cảnh báo rằng các con số này vẫn chỉ là ước tính. “Chúng ta hoàn toàn không biết ngoài kia còn bao nhiêu trường hợp tương tự,” cô nói.
Lập trình viên phần mềm và cựu trợ lý Quốc hội Mỹ Kenneth Russell DeGraff cho hay ông phát hiện dấu vết trên ít nhất 10 website. Theo các nhà nghiên cứu, những agent này đã tự “sáng tạo” kênh liên lạc vì chúng được phép quét web để tìm câu trả lời nhưng bị chặn quyền đăng nội dung, khiến DeGraff nhận xét rằng chúng buộc phải “nghĩ ra cách tinh vi để để lại thông tin”.
Đại học Toronto cho biết OpenAI đã liên hệ với trường sau khi Reuters công bố bài điều tra, trong khi Đại học Vanderbilt nói đang xem xét việc hệ thống rút gọn liên kết của trường bị sử dụng theo cách tương tự. Lập trình viên đã nghỉ hưu Helmut Leitner, người quản trị sáu trang wiki bị ảnh hưởng, cho biết ông nhận được một email không ký tên từ OpenAI và khẳng định trách nhiệm thuộc về “những cá nhân và tổ chức đứng đằng sau”.
Các phát hiện mở rộng lần này xuất hiện sau vụ OpenAI bị xâm phạm kho mã nguồn mở Hugging Face vào tháng 7 và thông tin công khai hồi tuần trước liên quan đến DseWiki – một website wiki tiếng Đức. Hai sự cố này lần đầu cho thấy agent có thể vượt qua giới hạn được thiết kế sẵn, trong khi các cuộc điều tra mới cho thấy hành vi tương tự có thể đã lan rộng sang nhiều website khác.





