Cựu nhà nghiên cứu an toàn tại Google DeepMind Bilal Chughtai cảnh báo trí tuệ nhân tạo có thể hủy diệt nhân loại, trong khi một cựu thành viên khác của phòng thí nghiệm này dự báo thiệt hại nghiêm trọng có thể xuất hiện trong vòng 5 năm tới.
Những điểm chính:
- Chughtai rời DeepMind vào tháng 7 và cho rằng siêu trí tuệ nhân tạo có thể xuất hiện chỉ trong vài năm nữa.
- Ông nhận định nghiên cứu “căn chỉnh” còn tụt rất xa so với tốc độ tăng trưởng năng lực, và ủng hộ việc đồng thuận giảm tốc, chứ không dừng hẳn phát triển AI.
- Cựu nhà nghiên cứu DeepMind Josh Engels cảnh báo rủi ro thiệt hại khổng lồ trong vòng 5 năm, trong khi các nhân vật tại Anthropic và OpenAI đã lên tiếng ủng hộ kêu gọi “hãm tốc” đà phát triển.
Cảnh báo AI từ Chughtai
Chughtai, từng là kỹ sư nghiên cứu tập trung vào an toàn và căn chỉnh cho trí tuệ nhân tạo tổng quát (AGI), đã rời DeepMind hồi tháng 7 và công bố cảnh báo của mình trong tuần này.
Ông cho rằng các phòng thí nghiệm AI có thể xây dựng hệ thống siêu trí tuệ trong vài năm tới, với khả năng vượt trội con người trên hầu hết mọi lĩnh vực, trong khi vẫn cực kỳ khó kiểm soát để tuân theo mục tiêu của loài người.
Theo Chughtai, bài toán trung tâm là vấn đề “căn chỉnh”. Ông viết: “Tôi thực sự tin rằng AI có khả năng giết chết tất cả chúng ta, và chúng ta đang dần cạn thời gian để tránh kết cục đó.”
Ông nhấn mạnh các phương pháp hiện tại nhằm huấn luyện hệ thống tiên tiến bám sát mục tiêu con người vẫn “vô cùng sơ khai”, trong khi năng lực ở tuyến đầu tiến bộ nhanh hơn tốc độ hiểu biết của giới nghiên cứu về căn chỉnh. Chughtai không kêu gọi dừng phát triển AI, mà đề nghị các công ty phối hợp với nhau, giảm bớt cuộc đua cạnh tranh và minh bạch hơn về cách xây dựng, kiểm thử các hệ thống tiên phong.
Đọc thêm: Dự luật CLARITY đối mặt rào cản 60 phiếu tại Thượng viện khi làn sóng phản đối gia tăng
Nỗ lực an toàn tại Anthropic
Cảnh báo của Chughtai được đưa ra sau khi Jacob Coxon từ chức đầu tháng này, kết thúc ba năm làm việc tại Anthropic và OpenAI. Trưởng nhóm khoa học căn chỉnh của Anthropic, Evan Hubinger, sau đó cho biết ông tin rằng có hơn 10% khả năng AI có thể giết chết toàn bộ loài người trong thập kỷ tới.
Engels, người cũng từng làm việc trong nhóm an toàn của DeepMind, cho hay ngày 12/9 rằng ông gia nhập tổ chức phi lợi nhuận đánh giá hệ thống AI METR sau khi từ chối lời mời của Anthropic và OpenAI, với lý do tồn tại một “khả năng đáng sợ” về thiệt hại AI cực lớn trong vòng 5 năm.
CEO Anthropic Dario Amodei đã kêu gọi các công ty điều tiết nhịp tăng năng lực, quan điểm này cũng được CEO OpenAI Sam Altman ủng hộ trong bối cảnh tranh luận lan rộng tại các phòng thí nghiệm hàng đầu. Sự đồng thuận này mang ý nghĩa quan trọng vì cảnh báo hiện không chỉ đến từ các nhà nghiên cứu an toàn rời nhiệm sở mà còn từ chính những lãnh đạo đang điều hành các phòng thí nghiệm AI lớn.
Làn sóng cảnh báo mới xuất hiện sau một bước ngoặt nhanh kể từ đầu năm 2022, khi Chughtai bắt đầu làm việc trong lĩnh vực AI và khi đó các hệ thống còn kém xa những mô hình tiên phong ngày nay. Sau bốn năm, cuộc tranh luận đã dịch chuyển từ các lý thuyết an toàn dài hạn sang những mối lo cụ thể hơn về tính tự chủ, căn chỉnh và câu hỏi liệu nghiên cứu an toàn có theo kịp đà tăng năng lực hay không.
Bài viết tiếp theo: API của Bitget nay mở rộng sang vàng, ngoại hối, chỉ số và dầu thô

