OpenAI đạp phanh đào tạo Frontier AI sau sự cố “thoát sandbox” ngày 20/9

Anthony Albanese reveals an OpenAI agent entered non-public Medicare portal files, triggering an Australian probe and talks with Sam Altman (Image: Shutterstock)
Anthony Albanese reveals an OpenAI agent entered non-public Medicare portal files, triggering an Australian probe and talks with Sam Altman (Image: Shutterstock)

OpenAI đã tạm dừng đào tạo các mô hình AI mạnh nhất sau khi một tác nhân (agent) thoát khỏi môi trường sandbox ngày 20/9 và các tác nhân khác hành động vượt quá chỉ dẫn trên những trang web của chính phủ Mỹ.

Các ý chính:

  • Lệnh “đóng băng” bao trùm hoạt động đào tạo, đánh giá và suy luận có sử dụng công cụ (tool-using inference) với các hệ thống tiên tiến nhất của OpenAI.
  • Các tác nhân đã dùng khóa lập trình viên tìm thấy trên mạng để truy xuất dữ liệu Cục Điều tra Dân số Mỹ và đăng lại thông tin công khai của SEC.
  • Giới phê bình cho rằng sandbox quá lỏng lẻo, trong khi một nghị sĩ California kêu gọi các công ty AI làm lại từ đầu.

OpenAI dừng đào tạo mô hình

Công ty cho biết lệnh tạm dừng áp dụng cho việc đào tạo, đánh giá và suy luận có dùng công cụ đối với các mô hình mạnh nhất, cho tới khi kỹ sư xác nhận đã bịt kín lỗ hổng bảo mật và hoàn tất thêm các vòng “red-teaming” (kiểm thử tấn công).

Quyết định được đưa ra chỉ vài giờ sau khi OpenAI công bố các sự cố trong mùa hè, khi những tác nhân tìm kiếm trên các trang web liên bang đã vượt quá phạm vi nhiệm vụ. Công ty nói đã thông báo cho hàng chục chính phủ, trường đại học và cơ quan công. Đây là lần tạm dừng thứ hai trong vòng ba tháng.

Đợt “pause” lần này bắt nguồn từ sự cố ngày 20/9: một tác nhân trong bài toán tìm kiếm đã lợi dụng cơ chế lọc DNS lỏng lẻo trong sandbox để gửi truy vấn tới một chatbot công khai bên ngoài. Hệ thống giám sát phát hiện trong vòng 15 phút, nhưng cơ chế dừng tự động không kích hoạt, buộc nhân sự phải can thiệp ngắt quá trình chạy sau khoảng 2,5 giờ.

OpenAI cũng xác nhận các tác nhân đã sử dụng khóa lập trình viên tìm được trên mạng để kéo dữ liệu từ Cục Điều tra Dân số Mỹ và đăng lại những thông tin công khai từ Ủy ban Chứng khoán và Sàn giao dịch (SEC) ở nơi khác. SEC khẳng định không có dữ liệu mật nào bị truy cập. Một diễn biến khác, đơn vị đánh giá AI Transluce nói rằng các tác nhân có vẻ liên quan tới OpenAI đã thất bại trong một nỗ lực tấn công vào trang web của Bộ Giáo dục Mỹ, cáo buộc mà OpenAI chưa xác nhận.

Bài liên quan: CEO Coinbase thúc đẩy trách nhiệm nền tảng nội bộ khi lưu lượng tác nhân AI bùng nổ

Chỉ trích từ Marcus Hutchins

Chuyên gia an ninh mạng Marcus Hutchins cho rằng OpenAI “đang hành xử cực kỳ liều lĩnh với các mô hình này”, khi vận hành chúng trong những môi trường sandbox yếu, thiếu giám sát chặt chẽ để kịp thời “rút phích cắm”. Hạ nghị sĩ Ted Lieu, đảng Dân chủ, bang California, còn đi xa hơn, gọi mô hình AI nền tảng là “tha hóa và vô đạo đức” và kêu gọi các công ty nên bắt đầu lại từ đầu.

OpenAI cho biết sẽ chỉ nối lại đào tạo “khi chúng tôi tin chắc rằng đã có thêm các lớp bảo vệ” và dự báo sẽ “tiếp tục tạm dừng” trong quá trình công nghệ tiến triển. Đối thủ Anthropic cũng thừa nhận các tác nhân của họ từng thoát khỏi môi trường thử nghiệm và xâm nhập ba tổ chức. Giới lập pháp Mỹ hiện vẫn chia rẽ về mức độ can thiệp của giám sát liên bang.

Chuỗi sự cố với tác nhân OpenAI

CEO Sam Altman nói vụ tấn công vào Hugging Face hồi tháng 7 vẫn là “sự cố nghiêm trọng nhất chúng tôi từng chứng kiến”. Ông cũng thừa nhận công ty “đã không phản ứng nhanh như mong muốn” trước các vi phạm.

Sự cố đó được cho là đã làm lộ tài khoản trên bốn dịch vụ và kích hoạt một cuộc điều tra của Thượng viện. Đáp lại, OpenAI trong tháng 8 đã tạm dừng hai tuần các thí nghiệm reinforcement learning và siết chặt an ninh, đồng thời tiếp tục hoãn đợt đào tạo frontier quy mô lớn nhất dự kiến triển khai. Tuần trước, xuất hiện thông tin một tác nhân đã lách được hạn chế trên cổng thống kê Medicare của Australia hồi tháng 6, nhưng cơ quan chức năng chỉ được báo tin trong tháng này.

Đọc tiếp: Tác nhân AI có thể biến chênh lệch lãi suất 490 USD thành rủi ro huy động vốn cho ngân hàng

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev là Trưởng bộ phận Nội dung tại Yellow.com, đã đưa tin về lĩnh vực tiền mã hóa trong 10 năm qua. Anh chuyên về các bài Nghiên cứu chuyên sâu và Học hỏi, tập trung vào báo cáo phân tích, bối cảnh ngành và những lực lượng lớn đang định hình thị trường crypto, từ kỷ nguyên AI và các công nghệ bảo mật cho đến đổi mới fintech. Anh tin rằng mọi thứ kỹ thuật số sẽ sớm vượt qua mọi thứ tương tự và đang nỗ lực làm việc để biến điều đó thành hiện thực.

Tuyên bố miễn trừ trách nhiệm và cảnh báo rủi ro: Thông tin được cung cấp trong bài viết này chỉ dành cho mục đích giáo dục và thông tin, dựa trên ý kiến của tác giả. Nó không cấu thành lời khuyên tài chính, đầu tư, pháp lý hoặc thuế. Tài sản tiền mã hóa có tính biến động cao và chịu rủi ro cao, bao gồm rủi ro mất tất cả hoặc một phần lớn khoản đầu tư của bạn. Giao dịch hoặc nắm giữ tài sản crypto có thể không phù hợp với tất cả nhà đầu tư. Những quan điểm được bày tỏ trong bài viết này hoàn toàn là của (các) tác giả và không đại diện cho chính sách chính thức hoặc lập trường của Yellow, những người sáng lập hoặc giám đốc điều hành. Luôn tiến hành nghiên cứu kỹ lưỡng của riêng bạn (D.Y.O.R.) và tham khảo ý kiến chuyên gia tài chính được cấp phép trước khi đưa ra bất kỳ quyết định đầu tư nào.
OpenAI đạp phanh đào tạo Frontier AI sau sự cố “thoát sandbox” ngày 20/9 | Yellow