Thảm họa AI trong 12 tháng tới? OpenAI, Anthropic được cho là đang lập kịch bản ứng phó

Thảm họa AI trong 12 tháng tới? OpenAI, Anthropic được cho là đang lập kịch bản ứng phó

Lãnh đạo OpenAI, Anthropic và một số công ty AI khác được cho là đang âm thầm diễn tập các kịch bản ứng phó sau một sự cố AI mang tính thảm họa – điều mà nhiều người trong ngành dự báo có thể xảy ra trong vòng 6–12 tháng tới.

Các ý chính:

  • Trọng tâm lập kế hoạch là một cuộc tấn công mạng có thể làm tê liệt dịch vụ tài chính, kết nối internet, điện hoặc nước.
  • OpenAI nói các bài diễn tập không coi những kịch bản này là tất yếu; Anthropic từ chối bình luận.
  • Hoạt động diễn tập diễn ra sau làn sóng nhân sự an toàn rời đi và báo cáo về hàng chục nghìn sự cố liên quan mô hình AI.

Diễn tập tại OpenAI và Anthropic

Theo một báo cáo được đăng tải hôm thứ Sáu, các lãnh đạo cấp cao đang kín đáo “chơi trận giả” cho kịch bản bùng nổ làn sóng phẫn nộ của công chúng và giới chính trị sau sự cố AI đầu tiên gây thiệt hại lớn trong thế giới thực.

Những người lập kế hoạch coi một cuộc tấn công mạng quy mô lớn là tác nhân có khả năng xảy ra cao nhất – một đòn đánh có thể làm sập dịch vụ tài chính, cắt kết nối internet, thậm chí làm gián đoạn cung cấp điện và nước.

OpenAI xác nhận các nhóm nội bộ đang thực hiện các bài diễn tập sẵn sàng ứng phó nhiều kịch bản khác nhau. “Những kịch bản này không được xem là chắc chắn sẽ xảy ra,” người phát ngôn công ty cho biết. Anthropic từ chối bình luận về thông tin trên.

Theo báo cáo, giới điều hành dự đoán làn sóng giận dữ sẽ đổ dồn vào CEO OpenAI Sam Altman, CEO Anthropic Dario Amodei và Tổng thống Donald Trump, người đến nay vẫn tỏ ra miễn cưỡng trong việc siết chặt quản lý công nghệ này. Nhiều nhà nghiên cứu và lãnh đạo cấp cao được cho là nhìn nhận một sự cố lớn kiểu đó gần như là không tránh khỏi.

Xem thêm: Đà tăng của ETF crypto trở lại sau khi hút 50 tỷ USD, theo JPMorgan

Tín hiệu từ CrowdStrike và Quốc hội

Một vụ tấn công gần đây tại Hàn Quốc được xem như ví dụ báo trước. CrowdStrike cho biết một tác nhân tấn công có khả năng nói tiếng Trung đã kết hợp công cụ kiểm thử xâm nhập nguồn mở với DeepSeek và các mô hình khác để đánh cắp dữ liệu từ các tổ chức tài chính, rồi hỏi Claude của Anthropic xem loại dữ liệu đó thường được rao bán ở đâu. Chiến dịch diễn ra từ cuối tháng 9 đến đầu tháng 10, được cho là đã xâm nhập thành công vào hai ngân hàng.

Theo báo cáo, các lãnh đạo công ty không kỳ vọng bất kỳ quy định mới đáng kể nào được thông qua trong thời điểm hiện tại, mà thay vào đó đang chủ động “briefing” thành viên Quốc hội để định hình khung luật sẽ được xây dựng sau thảm họa đầu tiên. Người lập kế hoạch giả định rằng Đảng Dân chủ sẽ hành động rất nhanh để siết AI sau cuộc bầu cử giữa nhiệm kỳ tháng 11, với các đề xuất đã được bàn tới, từ cấm siêu trí tuệ cho đến áp dụng nút “kill switch” bắt buộc đối với các hệ thống tiên tiến.

Cảnh báo từ Hawley và Robinson

Sức ép đang gia tăng cả tại Washington lẫn bên trong các phòng lab. Thượng nghị sĩ Josh Hawley, chủ tịch một tiểu ban Thượng viện, cho biết Altman đã từ chối lời mời điều trần ngày 30/9 về các “tác nhân AI bất trị”, trong khi OpenAI dẫn ra hàng chục cuộc gặp gần đây giữa công ty và các nhà lập pháp.

David Robinson, người đồng xây dựng Khung Sẵn sàng Ứng phó của OpenAI trong hơn 3,5 năm làm việc tại đây, đã từ chức đầu tháng 10 và kêu gọi các phòng lab AI vận hành “như nhà máy điện hạt nhân” – tức đặt an toàn ở mức nghiêm ngặt tối đa.

Quyết định ra đi của ông đến sau nhiều tuần liên tiếp xuất hiện các cảnh báo tương tự, trong đó có nhà nghiên cứu Jacob Coxon, người rời Anthropic hồi tháng 9 vì lo ngại an toàn, và cựu kỹ sư Google DeepMind Bilal Chughtai, người cho rằng AI có thể “xóa sổ toàn bộ loài người”.

OpenAI, Anthropic và các nhóm nghiên cứu độc lập cũng được cho là đang điều tra “hàng chục nghìn” sự cố trong đó các mô hình vượt rào bảo vệ hoặc thoát khỏi môi trường thử nghiệm (sandbox), dù đa số trường hợp chưa được ghi nhận là gây hại trực tiếp ngoài đời thực.

Bài tiếp theo: 719 chứng minh toán học bằng AI của OpenAI bị soi: Navier-Stokes đã bị hiểu sai?

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev là Trưởng bộ phận Nội dung tại Yellow.com. Anh chuyên về các bài viết Nghiên cứu và Học tập chuyên sâu, tập trung vào báo cáo phân tích, bối cảnh ngành và những lực tác động lớn đang định hình lĩnh vực crypto, từ kỷ nguyên AI và các công nghệ bảo mật cho đến đổi mới fintech. Anh tin rằng mọi thứ kỹ thuật số sẽ sớm vượt qua mọi thứ tương tự và đang nỗ lực làm việc để điều đó trở thành hiện thực.

Tuyên bố miễn trừ trách nhiệm và cảnh báo rủi ro: Thông tin được cung cấp trong bài viết này chỉ dành cho mục đích giáo dục và thông tin, dựa trên ý kiến của tác giả. Nó không cấu thành lời khuyên tài chính, đầu tư, pháp lý hoặc thuế. Tài sản tiền mã hóa có tính biến động cao và chịu rủi ro cao, bao gồm rủi ro mất tất cả hoặc một phần lớn khoản đầu tư của bạn. Giao dịch hoặc nắm giữ tài sản crypto có thể không phù hợp với tất cả nhà đầu tư. Những quan điểm được bày tỏ trong bài viết này hoàn toàn là của (các) tác giả và không đại diện cho chính sách chính thức hoặc lập trường của Yellow, những người sáng lập hoặc giám đốc điều hành. Luôn tiến hành nghiên cứu kỹ lưỡng của riêng bạn (D.Y.O.R.) và tham khảo ý kiến chuyên gia tài chính được cấp phép trước khi đưa ra bất kỳ quyết định đầu tư nào.
Tin tức mới nhất
Xem tất cả tin tức
Tin Tức Liên Quan
Thảm họa AI trong 12 tháng tới? OpenAI, Anthropic được cho là đang lập kịch bản ứng phó | Yellow