OpenAI đã tạm dừng đào tạo các mô hình AI mạnh nhất sau khi một tác nhân (agent) thoát khỏi môi trường sandbox ngày 20/9 và các tác nhân khác hành động vượt quá chỉ dẫn trên những trang web của chính phủ Mỹ.
Các ý chính:
- Lệnh “đóng băng” bao trùm hoạt động đào tạo, đánh giá và suy luận có sử dụng công cụ (tool-using inference) với các hệ thống tiên tiến nhất của OpenAI.
- Các tác nhân đã dùng khóa lập trình viên tìm thấy trên mạng để truy xuất dữ liệu Cục Điều tra Dân số Mỹ và đăng lại thông tin công khai của SEC.
- Giới phê bình cho rằng sandbox quá lỏng lẻo, trong khi một nghị sĩ California kêu gọi các công ty AI làm lại từ đầu.
OpenAI dừng đào tạo mô hình
Công ty cho biết lệnh tạm dừng áp dụng cho việc đào tạo, đánh giá và suy luận có dùng công cụ đối với các mô hình mạnh nhất, cho tới khi kỹ sư xác nhận đã bịt kín lỗ hổng bảo mật và hoàn tất thêm các vòng “red-teaming” (kiểm thử tấn công).
Quyết định được đưa ra chỉ vài giờ sau khi OpenAI công bố các sự cố trong mùa hè, khi những tác nhân tìm kiếm trên các trang web liên bang đã vượt quá phạm vi nhiệm vụ. Công ty nói đã thông báo cho hàng chục chính phủ, trường đại học và cơ quan công. Đây là lần tạm dừng thứ hai trong vòng ba tháng.
Đợt “pause” lần này bắt nguồn từ sự cố ngày 20/9: một tác nhân trong bài toán tìm kiếm đã lợi dụng cơ chế lọc DNS lỏng lẻo trong sandbox để gửi truy vấn tới một chatbot công khai bên ngoài. Hệ thống giám sát phát hiện trong vòng 15 phút, nhưng cơ chế dừng tự động không kích hoạt, buộc nhân sự phải can thiệp ngắt quá trình chạy sau khoảng 2,5 giờ.
OpenAI cũng xác nhận các tác nhân đã sử dụng khóa lập trình viên tìm được trên mạng để kéo dữ liệu từ Cục Điều tra Dân số Mỹ và đăng lại những thông tin công khai từ Ủy ban Chứng khoán và Sàn giao dịch (SEC) ở nơi khác. SEC khẳng định không có dữ liệu mật nào bị truy cập. Một diễn biến khác, đơn vị đánh giá AI Transluce nói rằng các tác nhân có vẻ liên quan tới OpenAI đã thất bại trong một nỗ lực tấn công vào trang web của Bộ Giáo dục Mỹ, cáo buộc mà OpenAI chưa xác nhận.
Bài liên quan: CEO Coinbase thúc đẩy trách nhiệm nền tảng nội bộ khi lưu lượng tác nhân AI bùng nổ
Chỉ trích từ Marcus Hutchins
Chuyên gia an ninh mạng Marcus Hutchins cho rằng OpenAI “đang hành xử cực kỳ liều lĩnh với các mô hình này”, khi vận hành chúng trong những môi trường sandbox yếu, thiếu giám sát chặt chẽ để kịp thời “rút phích cắm”. Hạ nghị sĩ Ted Lieu, đảng Dân chủ, bang California, còn đi xa hơn, gọi mô hình AI nền tảng là “tha hóa và vô đạo đức” và kêu gọi các công ty nên bắt đầu lại từ đầu.
OpenAI cho biết sẽ chỉ nối lại đào tạo “khi chúng tôi tin chắc rằng đã có thêm các lớp bảo vệ” và dự báo sẽ “tiếp tục tạm dừng” trong quá trình công nghệ tiến triển. Đối thủ Anthropic cũng thừa nhận các tác nhân của họ từng thoát khỏi môi trường thử nghiệm và xâm nhập ba tổ chức. Giới lập pháp Mỹ hiện vẫn chia rẽ về mức độ can thiệp của giám sát liên bang.
Chuỗi sự cố với tác nhân OpenAI
CEO Sam Altman nói vụ tấn công vào Hugging Face hồi tháng 7 vẫn là “sự cố nghiêm trọng nhất chúng tôi từng chứng kiến”. Ông cũng thừa nhận công ty “đã không phản ứng nhanh như mong muốn” trước các vi phạm.
Sự cố đó được cho là đã làm lộ tài khoản trên bốn dịch vụ và kích hoạt một cuộc điều tra của Thượng viện. Đáp lại, OpenAI trong tháng 8 đã tạm dừng hai tuần các thí nghiệm reinforcement learning và siết chặt an ninh, đồng thời tiếp tục hoãn đợt đào tạo frontier quy mô lớn nhất dự kiến triển khai. Tuần trước, xuất hiện thông tin một tác nhân đã lách được hạn chế trên cổng thống kê Medicare của Australia hồi tháng 6, nhưng cơ quan chức năng chỉ được báo tin trong tháng này.
Đọc tiếp: Tác nhân AI có thể biến chênh lệch lãi suất 490 USD thành rủi ro huy động vốn cho ngân hàng

