Lãnh đạo OpenAI, Anthropic và một số công ty AI khác được cho là đang âm thầm diễn tập các kịch bản ứng phó sau một sự cố AI mang tính thảm họa – điều mà nhiều người trong ngành dự báo có thể xảy ra trong vòng 6–12 tháng tới.
Các ý chính:
- Trọng tâm lập kế hoạch là một cuộc tấn công mạng có thể làm tê liệt dịch vụ tài chính, kết nối internet, điện hoặc nước.
- OpenAI nói các bài diễn tập không coi những kịch bản này là tất yếu; Anthropic từ chối bình luận.
- Hoạt động diễn tập diễn ra sau làn sóng nhân sự an toàn rời đi và báo cáo về hàng chục nghìn sự cố liên quan mô hình AI.
Diễn tập tại OpenAI và Anthropic
Theo một báo cáo được đăng tải hôm thứ Sáu, các lãnh đạo cấp cao đang kín đáo “chơi trận giả” cho kịch bản bùng nổ làn sóng phẫn nộ của công chúng và giới chính trị sau sự cố AI đầu tiên gây thiệt hại lớn trong thế giới thực.
Những người lập kế hoạch coi một cuộc tấn công mạng quy mô lớn là tác nhân có khả năng xảy ra cao nhất – một đòn đánh có thể làm sập dịch vụ tài chính, cắt kết nối internet, thậm chí làm gián đoạn cung cấp điện và nước.
OpenAI xác nhận các nhóm nội bộ đang thực hiện các bài diễn tập sẵn sàng ứng phó nhiều kịch bản khác nhau. “Những kịch bản này không được xem là chắc chắn sẽ xảy ra,” người phát ngôn công ty cho biết. Anthropic từ chối bình luận về thông tin trên.
Theo báo cáo, giới điều hành dự đoán làn sóng giận dữ sẽ đổ dồn vào CEO OpenAI Sam Altman, CEO Anthropic Dario Amodei và Tổng thống Donald Trump, người đến nay vẫn tỏ ra miễn cưỡng trong việc siết chặt quản lý công nghệ này. Nhiều nhà nghiên cứu và lãnh đạo cấp cao được cho là nhìn nhận một sự cố lớn kiểu đó gần như là không tránh khỏi.
Xem thêm: Đà tăng của ETF crypto trở lại sau khi hút 50 tỷ USD, theo JPMorgan
Tín hiệu từ CrowdStrike và Quốc hội
Một vụ tấn công gần đây tại Hàn Quốc được xem như ví dụ báo trước. CrowdStrike cho biết một tác nhân tấn công có khả năng nói tiếng Trung đã kết hợp công cụ kiểm thử xâm nhập nguồn mở với DeepSeek và các mô hình khác để đánh cắp dữ liệu từ các tổ chức tài chính, rồi hỏi Claude của Anthropic xem loại dữ liệu đó thường được rao bán ở đâu. Chiến dịch diễn ra từ cuối tháng 9 đến đầu tháng 10, được cho là đã xâm nhập thành công vào hai ngân hàng.
Theo báo cáo, các lãnh đạo công ty không kỳ vọng bất kỳ quy định mới đáng kể nào được thông qua trong thời điểm hiện tại, mà thay vào đó đang chủ động “briefing” thành viên Quốc hội để định hình khung luật sẽ được xây dựng sau thảm họa đầu tiên. Người lập kế hoạch giả định rằng Đảng Dân chủ sẽ hành động rất nhanh để siết AI sau cuộc bầu cử giữa nhiệm kỳ tháng 11, với các đề xuất đã được bàn tới, từ cấm siêu trí tuệ cho đến áp dụng nút “kill switch” bắt buộc đối với các hệ thống tiên tiến.
Cảnh báo từ Hawley và Robinson
Sức ép đang gia tăng cả tại Washington lẫn bên trong các phòng lab. Thượng nghị sĩ Josh Hawley, chủ tịch một tiểu ban Thượng viện, cho biết Altman đã từ chối lời mời điều trần ngày 30/9 về các “tác nhân AI bất trị”, trong khi OpenAI dẫn ra hàng chục cuộc gặp gần đây giữa công ty và các nhà lập pháp.
David Robinson, người đồng xây dựng Khung Sẵn sàng Ứng phó của OpenAI trong hơn 3,5 năm làm việc tại đây, đã từ chức đầu tháng 10 và kêu gọi các phòng lab AI vận hành “như nhà máy điện hạt nhân” – tức đặt an toàn ở mức nghiêm ngặt tối đa.
Quyết định ra đi của ông đến sau nhiều tuần liên tiếp xuất hiện các cảnh báo tương tự, trong đó có nhà nghiên cứu Jacob Coxon, người rời Anthropic hồi tháng 9 vì lo ngại an toàn, và cựu kỹ sư Google DeepMind Bilal Chughtai, người cho rằng AI có thể “xóa sổ toàn bộ loài người”.
OpenAI, Anthropic và các nhóm nghiên cứu độc lập cũng được cho là đang điều tra “hàng chục nghìn” sự cố trong đó các mô hình vượt rào bảo vệ hoặc thoát khỏi môi trường thử nghiệm (sandbox), dù đa số trường hợp chưa được ghi nhận là gây hại trực tiếp ngoài đời thực.
Bài tiếp theo: 719 chứng minh toán học bằng AI của OpenAI bị soi: Navier-Stokes đã bị hiểu sai?

