Cựu chuyên gia an toàn của Google DeepMind, Bilal Chughtai, cảnh báo AI có thể dẫn tới kịch bản hủy diệt nhân loại, trong khi một cựu nhà nghiên cứu khác dự báo các tác hại nghiêm trọng có thể xuất hiện ngay trong vòng 5 năm tới.
Các điểm chính:
- Chughtai rời DeepMind vào tháng 7 và nhận định AI siêu trí tuệ có thể xuất hiện trong vài năm tới.
- Ông cho rằng nghiên cứu căn chỉnh đang tụt hậu so với tốc độ tăng trưởng năng lực mô hình, và ủng hộ việc điều phối để giảm tốc, chứ không phải dừng hẳn phát triển AI.
- Cựu nhà nghiên cứu DeepMind Josh Engels cảnh báo rủi ro gây hại ở quy mô khổng lồ trong vòng 5 năm, trong khi các nhân vật tại Anthropic và OpenAI cũng đã ủng hộ lời kêu gọi “hãm phanh” đà phát triển.
Cảnh báo về AI của Chughtai
Chughtai, từng là kỹ sư nghiên cứu tập trung vào an toàn và căn chỉnh cho trí tuệ nhân tạo tổng quát (AGI), đã rời DeepMind vào tháng 7 và tuần này công bố cảnh báo chi tiết của mình.
Ông cho rằng các phòng thí nghiệm AI có thể xây dựng hệ thống siêu trí tuệ chỉ trong vài năm tới – những hệ thống có thể vượt trội con người trong hầu hết mọi lĩnh vực, song lại rất khó được căn chỉnh để tuân thủ đầy đủ mục tiêu và giá trị của con người.
Chughtai nhấn mạnh “điểm nghẽn” cốt lõi nằm ở bài toán căn chỉnh, viết rằng: “Tôi thực sự tin rằng AI có tiềm năng giết chết tất cả chúng ta, và chúng ta có thể đang dần cạn thời gian để tránh kịch bản này.”
Theo ông, các phương pháp hiện nay để huấn luyện hệ thống tiên tiến một cách đáng tin cậy nhằm theo đuổi mục tiêu của con người vẫn “cực kỳ sơ khai”, trong khi năng lực ở tuyến đầu lại tăng với tốc độ nhanh hơn rất nhiều so với tốc độ hiểu biết của giới nghiên cứu về căn chỉnh. Chughtai không kêu gọi dừng phát triển AI, mà muốn các công ty phối hợp với nhau, giảm bớt cuộc đua cạnh tranh và minh bạch hơn về cách họ xây dựng, kiểm thử các hệ thống tiên phong.
Đọc thêm: Đạo luật CLARITY đối mặt bài kiểm tra 60 phiếu tại Thượng viện khi làn sóng phản đối gia tăng
Nỗ lực an toàn tại Anthropic
Cảnh báo của Chughtai được đưa ra sau khi Jacob Coxon tuyên bố từ chức hồi đầu tháng, sau ba năm làm việc tại Anthropic và OpenAI. Trưởng nhóm khoa học căn chỉnh của Anthropic, Evan Hubinger, sau đó cho biết ông tin rằng có hơn 10% khả năng AI có thể giết hết loài người trong vòng 10 năm tới.
Engels, người từng tham gia nhóm an toàn của DeepMind, cho biết ngày 12/9 rằng ông đã gia nhập tổ chức phi lợi nhuận chuyên đánh giá rủi ro METR sau khi từ chối lời mời từ Anthropic và OpenAI, viện dẫn “khả năng đáng sợ” về tổn hại AI ở quy mô khổng lồ trong 5 năm tới.
CEO Anthropic Dario Amodei trước đó đã kêu gọi các doanh nghiệp điều tiết tốc độ nâng cao năng lực mô hình, một quan điểm cũng được CEO OpenAI Sam Altman ủng hộ, trong bối cảnh tranh luận lan rộng giữa các phòng thí nghiệm AI hàng đầu. Sự đồng thuận này có ý nghĩa đáng kể khi các cảnh báo không chỉ xuất phát từ đội ngũ an toàn đã rời đi, mà còn từ chính các lãnh đạo đang vận hành những phòng lab lớn.
Làn sóng cảnh báo hiện nay đánh dấu bước ngoặt nhanh chóng so với đầu năm 2022, thời điểm Chughtai mới bắt tay vào nghiên cứu AI và mô tả các hệ thống khi đó là kém xa so với những mô hình tiên phong ngày nay. Chỉ trong khoảng bốn năm, cuộc tranh luận đã chuyển từ các lý thuyết an toàn dài hạn sang những lo ngại rất cụ thể về mức độ tự chủ của hệ thống, vấn đề căn chỉnh, và câu hỏi liệu nghiên cứu an toàn có thể bắt kịp tốc độ tăng trưởng năng lực hay không.
Bài tiếp theo: API của Bitget nay tiếp cận vàng, forex, chỉ số và dầu thô

