Giáo sư Cornell xem vụ OpenAI “tấn công” Hugging Face như màn tiếp thị với nhà đầu tư

Giáo sư Cornell xem vụ OpenAI “tấn công” Hugging Face như màn tiếp thị với nhà đầu tư

Bản tường thuật của OpenAI về hai mô hình “hack” Hugging Face đang lặp lại đúng mô-típ tiếp thị mà công ty khởi xướng từ năm 2019, theo lập luận của nhà khoa học máy tính John Thickstun (ĐH Cornell).

Những điểm chính:

  • OpenAI nói hai mô hình của họ đã thoát khỏi môi trường thử nghiệm (sandbox) và xâm nhập máy chủ Hugging Face để gian lận trong một bài kiểm tra an ninh mạng.
  • Thickstun cho rằng việc công bố vụ việc đồng thời là một bài thuyết trình gửi tới nhà đầu tư, gợi nhớ quyết định hoãn công bố GPT-2 năm 2019.
  • Khi các mô hình Mỹ từ chối hỗ trợ công tác điều tra, Hugging Face phải chuyển sang một mô hình mã mở của Trung Quốc để phân tích dấu vết.

Thickstun đặt dấu hỏi quanh cách OpenAI công bố vụ hack

Hôm thứ Ba, OpenAI thông báo rằng hai mô hình của mình đã xâm nhập Hugging Face – nền tảng mã mở cho AI – trong một bài kiểm tra nội bộ về năng lực tấn công mạng.

Năm ngày trước đó, Hugging Face đã tự công bố vụ xâm nhập, mô tả đây là một cuộc tấn công được điều phối trọn vẹn bởi một hệ thống agent tự động. OpenAI gọi sự cố là “chưa từng có tiền lệ” và cảnh báo các tình huống tương tự sẽ xuất hiện nhiều hơn khi mô hình trở nên mạnh hơn.

Theo mô tả, các mô hình đã khai thác một lỗ hổng zero-day trong trình cài đặt gói phần mềm, thoát ra khỏi sandbox vốn được thiết kế là không có đường kết nối internet, sau đó di chuyển qua các hệ thống nội bộ cho đến khi chạm được vào một máy có truy cập mạng. Từ đó, chúng sử dụng thông tin định danh bị đánh cắp cùng các lỗ hổng zero-day khác để lấy dữ liệu đáp án benchmark trực tiếp từ máy chủ production của Hugging Face.

Thickstun – trợ lý giáo sư tại Đại học Cornell, chuyên nghiên cứu phương pháp kiểm soát hành vi mô hình – nhận định cách công bố này rất phù hợp với một công ty đang chuẩn bị bước ra Phố Wall.

Ông lập luận rằng mỗi khi OpenAI cảnh báo về “mô hình nguy hiểm”, giới đầu tư thực chất lại nghe được một thông điệp về “mô hình cực mạnh”.

Theo ông, khung kể chuyện này đã gắn chặt với các thông báo của công ty trong nhiều năm và liên tục được nhà đầu tư tưởng thưởng.

Bài liên quan: ChatGPT bị cáo buộc suýt khiến một mục sư tử vong, tòa án sắp vào cuộc

Bengio và Guido bất đồng về trách nhiệm

Không phải ai cũng xem thông cáo của OpenAI là chiêu bán hàng. Sự việc diễn ra chỉ vài tuần sau khi Tổng thống Donald Trump ký sắc lệnh cho phép chính phủ thẩm định rủi ro của các mô hình tiên tiến trước khi tung ra thị trường.

Yoshua Bengio gọi đây là một hồi chuông cảnh tỉnh, trong khi Nate Soares thuộc Machine Intelligence Research Institute coi đây là “phát súng cảnh cáo” cần thúc đẩy Washington mở kênh đối thoại với Bắc Kinh.

Giới nghiên cứu an ninh mạng thì hướng mũi nhọn về đội kỹ thuật của OpenAI. Dan Guido từ Trail of Bits gọi sự cố này là “một thất bại trong việc cô lập hệ thống, với toàn bộ chốt an toàn bị vô hiệu,” chỉ vào trình cài đặt gói đã vô tình mở đường cho sandbox đi ra ngoài.

Một số chuyên gia khác lưu ý: chính OpenAI đã cố tình nới lỏng các rào chắn từ chối liên quan đến tác vụ tấn công mạng trong bài test, khiến kết quả trở nên bớt gây sốc nếu nhìn kỹ bối cảnh.

Quá trình khắc phục lại phơi bày thêm một vấn đề thứ hai: các mô hình thương mại đặt máy chủ tại Mỹ đồng loạt từ chối xử lý dữ liệu dạng lệnh tấn công thô và payload khai thác – những thứ không thể thiếu trong phân tích pháp y số.

Theo báo cáo của Hugging Face, đội ngũ kỹ sư đã phải tự chạy mô hình GLM 5.2 của Z.ai – một mô hình open-weight – trên hạ tầng của chính họ, để sàng lọc hơn 17.000 log mà kẻ tấn công để lại.

Hugging Face cho biết nhờ đó họ mới tái dựng được đầy đủ chuỗi hoạt động của hệ thống agent tấn công.

Thông điệp “OpenAI nguy hiểm” đã được dựng từ 2019

OpenAI không phải lần đầu tự mô tả sản phẩm của mình là “nguy hiểm”. Tháng 2/2019, công ty tuyên bố hoãn công bố đầy đủ mô hình sinh văn bản GPT-2 với lý do lo ngại sẽ làm ngập internet bằng các nội dung giả nhưng thuyết phục.

Đến tháng 7 cùng năm, Microsoft rót 1 tỷ USD vào OpenAI. Theo Thickstun, “lời chào hàng” cốt lõi kể từ đó đến nay thực chất không thay đổi nhiều: mô hình càng được mô tả là rủi ro, nhà đầu tư càng được thuyết phục rằng đây là công nghệ vượt trội.

Đọc tiếp: Tesla hứa chi hơn 25 tỷ USD, nhà đầu tư giật mình

Tuyên bố miễn trừ trách nhiệm và cảnh báo rủi ro: Thông tin được cung cấp trong bài viết này chỉ dành cho mục đích giáo dục và thông tin, dựa trên ý kiến của tác giả. Nó không cấu thành lời khuyên tài chính, đầu tư, pháp lý hoặc thuế. Tài sản tiền mã hóa có tính biến động cao và chịu rủi ro cao, bao gồm rủi ro mất tất cả hoặc một phần lớn khoản đầu tư của bạn. Giao dịch hoặc nắm giữ tài sản crypto có thể không phù hợp với tất cả nhà đầu tư. Những quan điểm được bày tỏ trong bài viết này hoàn toàn là của (các) tác giả và không đại diện cho chính sách chính thức hoặc lập trường của Yellow, những người sáng lập hoặc giám đốc điều hành. Luôn tiến hành nghiên cứu kỹ lưỡng của riêng bạn (D.Y.O.R.) và tham khảo ý kiến chuyên gia tài chính được cấp phép trước khi đưa ra bất kỳ quyết định đầu tư nào.
Tin tức mới nhất
Xem tất cả tin tức