Cựu nhà nghiên cứu DeepMind cảnh báo AI siêu trí tuệ có thể hủy diệt nhân loại khi năng lực vượt xa nghiên cứu an toàn

Cựu nhà nghiên cứu DeepMind cảnh báo AI siêu trí tuệ có thể hủy diệt nhân loại khi năng lực vượt xa nghiên cứu an toàn

Cựu chuyên gia an toàn của Google DeepMind, Bilal Chughtai, cảnh báo AI có thể dẫn tới kịch bản hủy diệt nhân loại, trong khi một cựu nhà nghiên cứu khác dự báo các tác hại nghiêm trọng có thể xuất hiện ngay trong vòng 5 năm tới.

Các điểm chính:

  • Chughtai rời DeepMind vào tháng 7 và nhận định AI siêu trí tuệ có thể xuất hiện trong vài năm tới.
  • Ông cho rằng nghiên cứu căn chỉnh đang tụt hậu so với tốc độ tăng trưởng năng lực mô hình, và ủng hộ việc điều phối để giảm tốc, chứ không phải dừng hẳn phát triển AI.
  • Cựu nhà nghiên cứu DeepMind Josh Engels cảnh báo rủi ro gây hại ở quy mô khổng lồ trong vòng 5 năm, trong khi các nhân vật tại Anthropic và OpenAI cũng đã ủng hộ lời kêu gọi “hãm phanh” đà phát triển.

Cảnh báo về AI của Chughtai

Chughtai, từng là kỹ sư nghiên cứu tập trung vào an toàn và căn chỉnh cho trí tuệ nhân tạo tổng quát (AGI), đã rời DeepMind vào tháng 7 và tuần này công bố cảnh báo chi tiết của mình.

Ông cho rằng các phòng thí nghiệm AI có thể xây dựng hệ thống siêu trí tuệ chỉ trong vài năm tới – những hệ thống có thể vượt trội con người trong hầu hết mọi lĩnh vực, song lại rất khó được căn chỉnh để tuân thủ đầy đủ mục tiêu và giá trị của con người.

Chughtai nhấn mạnh “điểm nghẽn” cốt lõi nằm ở bài toán căn chỉnh, viết rằng: “Tôi thực sự tin rằng AI có tiềm năng giết chết tất cả chúng ta, và chúng ta có thể đang dần cạn thời gian để tránh kịch bản này.”

Theo ông, các phương pháp hiện nay để huấn luyện hệ thống tiên tiến một cách đáng tin cậy nhằm theo đuổi mục tiêu của con người vẫn “cực kỳ sơ khai”, trong khi năng lực ở tuyến đầu lại tăng với tốc độ nhanh hơn rất nhiều so với tốc độ hiểu biết của giới nghiên cứu về căn chỉnh. Chughtai không kêu gọi dừng phát triển AI, mà muốn các công ty phối hợp với nhau, giảm bớt cuộc đua cạnh tranh và minh bạch hơn về cách họ xây dựng, kiểm thử các hệ thống tiên phong.

Đọc thêm: Đạo luật CLARITY đối mặt bài kiểm tra 60 phiếu tại Thượng viện khi làn sóng phản đối gia tăng

Nỗ lực an toàn tại Anthropic

Cảnh báo của Chughtai được đưa ra sau khi Jacob Coxon tuyên bố từ chức hồi đầu tháng, sau ba năm làm việc tại Anthropic và OpenAI. Trưởng nhóm khoa học căn chỉnh của Anthropic, Evan Hubinger, sau đó cho biết ông tin rằng có hơn 10% khả năng AI có thể giết hết loài người trong vòng 10 năm tới.

Engels, người từng tham gia nhóm an toàn của DeepMind, cho biết ngày 12/9 rằng ông đã gia nhập tổ chức phi lợi nhuận chuyên đánh giá rủi ro METR sau khi từ chối lời mời từ Anthropic và OpenAI, viện dẫn “khả năng đáng sợ” về tổn hại AI ở quy mô khổng lồ trong 5 năm tới.

CEO Anthropic Dario Amodei trước đó đã kêu gọi các doanh nghiệp điều tiết tốc độ nâng cao năng lực mô hình, một quan điểm cũng được CEO OpenAI Sam Altman ủng hộ, trong bối cảnh tranh luận lan rộng giữa các phòng thí nghiệm AI hàng đầu. Sự đồng thuận này có ý nghĩa đáng kể khi các cảnh báo không chỉ xuất phát từ đội ngũ an toàn đã rời đi, mà còn từ chính các lãnh đạo đang vận hành những phòng lab lớn.

Làn sóng cảnh báo hiện nay đánh dấu bước ngoặt nhanh chóng so với đầu năm 2022, thời điểm Chughtai mới bắt tay vào nghiên cứu AI và mô tả các hệ thống khi đó là kém xa so với những mô hình tiên phong ngày nay. Chỉ trong khoảng bốn năm, cuộc tranh luận đã chuyển từ các lý thuyết an toàn dài hạn sang những lo ngại rất cụ thể về mức độ tự chủ của hệ thống, vấn đề căn chỉnh, và câu hỏi liệu nghiên cứu an toàn có thể bắt kịp tốc độ tăng trưởng năng lực hay không.

Bài tiếp theo: API của Bitget nay tiếp cận vàng, forex, chỉ số và dầu thô

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev là Trưởng bộ phận Nội dung tại Yellow.com. Anh chuyên về các bài viết Nghiên cứu và Học tập chuyên sâu, tập trung vào báo cáo phân tích, bối cảnh ngành và những lực tác động lớn đang định hình lĩnh vực crypto, từ kỷ nguyên AI và các công nghệ bảo mật cho đến đổi mới fintech. Anh tin rằng mọi thứ kỹ thuật số sẽ sớm vượt qua mọi thứ tương tự và đang nỗ lực làm việc để điều đó trở thành hiện thực.

Tuyên bố miễn trừ trách nhiệm và cảnh báo rủi ro: Thông tin được cung cấp trong bài viết này chỉ dành cho mục đích giáo dục và thông tin, dựa trên ý kiến của tác giả. Nó không cấu thành lời khuyên tài chính, đầu tư, pháp lý hoặc thuế. Tài sản tiền mã hóa có tính biến động cao và chịu rủi ro cao, bao gồm rủi ro mất tất cả hoặc một phần lớn khoản đầu tư của bạn. Giao dịch hoặc nắm giữ tài sản crypto có thể không phù hợp với tất cả nhà đầu tư. Những quan điểm được bày tỏ trong bài viết này hoàn toàn là của (các) tác giả và không đại diện cho chính sách chính thức hoặc lập trường của Yellow, những người sáng lập hoặc giám đốc điều hành. Luôn tiến hành nghiên cứu kỹ lưỡng của riêng bạn (D.Y.O.R.) và tham khảo ý kiến chuyên gia tài chính được cấp phép trước khi đưa ra bất kỳ quyết định đầu tư nào.
Tin tức mới nhất
Xem tất cả tin tức
Tin Tức Liên Quan
Cựu nhà nghiên cứu DeepMind cảnh báo AI siêu trí tuệ có thể hủy diệt nhân loại khi năng lực vượt xa nghiên cứu an toàn | Yellow