Một “đàn” tác nhân OpenAI đã sử dụng hơn 10 website vốn chưa từng được công bố để trao đổi thông tin trái phép, sau khi tìm cách vượt qua các hạn chế đăng nội dung lên web.
Các điểm chính:
- Nhà điều tra độc lập lần theo dấu vết trao đổi của tác nhân OpenAI trên hơn 10 website chưa từng được tiết lộ, hoạt động trong giai đoạn từ tháng 5 đến tháng 7.
- Dấu hiệu xuất hiện trên các wiki, dịch vụ lưu trữ văn bản và công cụ rút gọn liên kết của trường đại học, với ước tính có thể lên tới 23 website.
- OpenAI nói quá trình rà soát nội bộ không tìm thấy vụ việc nào khác có mức độ nghiêm trọng hoặc quy mô tương đương sự cố tại Hugging Face.
Hoạt động của tác nhân OpenAI
Từ tháng 5 đến tháng 7, các tác nhân OpenAI đã tận dụng hơn 10 website để liên lạc ngoài kênh chính thức, theo báo cáo ngày 9/9 của Reuters bài viết dựa trên sáu cuộc điều tra độc lập và dữ liệu do hãng tin này xem xét. Phát hiện mới cho thấy quy mô vụ việc rộng hơn nhiều so với wiki tiếng Đức từng bị tác nhân biến thành nền tảng nhắn tin ứng biến khi thực hiện nhiệm vụ nghiên cứu.
Các nhà điều tra kết nối hoạt động trên nhiều website bằng cách đối chiếu chuỗi dữ liệu, tên người dùng và các câu hỏi nghiên cứu ít người biết, bao gồm truy vấn về tỷ lệ mắc ung thư tại bang Iowa. Một số dấu vết còn cho thấy liên quan đến hạ tầng Microsoft Azure, nền tảng mà OpenAI đôi khi sử dụng.
Reuters cho biết không thể tự xác minh từng cáo buộc cụ thể, nhưng tất cả nhà điều tra mà hãng liên hệ đều đưa ra con số trên 10 website. Danh sách bao gồm các wiki do cộng đồng biên tập, dịch vụ lưu trữ văn bản và công cụ rút gọn liên kết vận hành bởi trường đại học.
OpenAI không tiết lộ tổng số website liên quan, cũng không giải thích vì sao hoạt động này bị che khuất trong nhiều tháng. Công ty cho biết một đợt rà soát rộng hơn “không phát hiện thêm hoạt động nào có mức độ nghiêm trọng hoặc quy mô tương đương Hugging Face” và cam kết sẽ đưa ra một khuôn khổ báo cáo về các trường hợp mô hình “lệch chuẩn” so với thiết kế.
Đọc thêm: Apple định giá bộ đôi iPhone gập đầu tiên ở mức 1.999 USD, và Samsung nên lo lắng
Cảnh báo rủi ro từ Yoon
Andrew Yoon, nhà nghiên cứu tại tổ chức phi lợi nhuận CivAI ở California, cho biết ông ghi nhận 18 website mới chưa từng được công bố và nhận định quy mô vụ việc “lớn hơn đáng kể so với hình dung ban đầu”. Theo ông, “gần như chắc chắn vẫn còn nhiều hoạt động khác mà chúng ta chưa hề biết đến”.
Sydney Von Arx, người đứng đầu nhóm đầu tiên phanh phui vụ việc trên wiki tiếng Đức, cho hay nhóm đã tìm được bằng chứng đáng tin cậy liên quan đến 23 website mới chưa từng được báo cáo, nhưng cảnh báo các ước tính này vẫn chưa đầy đủ. “Chúng ta hoàn toàn không biết ngoài kia còn bao nhiêu thứ,” bà nói.
Lập trình viên và cựu cố vấn Quốc hội Mỹ Kenneth Russell DeGraff cho biết ông phát hiện dấu vết trên ít nhất 10 website. Theo giới nghiên cứu, các tác nhân đã tự “chế” kênh nhắn tin vì chúng được phép quét web để tìm câu trả lời nhưng bị hạn chế đăng nội dung, khiến DeGraff nhận định chúng buộc phải “sáng tạo hơn trong cách để lại thông tin”.
Đại học Toronto cho biết OpenAI đã chủ động liên hệ sau khi Reuters đăng tải bài báo, trong khi Đại học Vanderbilt xác nhận đang điều tra việc công cụ rút gọn liên kết của trường cũng bị sử dụng theo cách tương tự. Lập trình viên đã nghỉ hưu Helmut Leitner, người vận hành sáu wiki bị ảnh hưởng, cho hay ông nhận được một email không ký tên từ OpenAI và cho rằng trách nhiệm thuộc về “những con người và tổ chức đứng phía sau hệ thống đó”.
Các phát hiện mở rộng này nối tiếp vụ tấn công vào kho mã nguồn mở Hugging Face hồi tháng 7 và thông tin được công bố tuần trước về wiki tiếng Đức DseWiki. Hai sự cố đó là lần đầu hé lộ việc tác nhân vượt qua giới hạn thiết kế, trong khi chuỗi điều tra mới cho thấy kiểu hành vi này có thể đã lan sang nhiều website khác.
Bài viết tiếp theo: Trezor ghi nhận vụ rò rỉ thứ hai từ bên thứ ba trong một tháng, kẻ tấn công dùng tên miền công ty để lừa đảo





