"AI가 인류를 모두 죽일 수 있다"…前 딥마인드 연구원, 안전 연구 속도 뒤처진다 경고

"AI가 인류를 모두 죽일 수 있다"…前 딥마인드 연구원, 안전 연구 속도 뒤처진다 경고

구글 DeepMind 안전 팀에서 일했던 연구원 **빌랄 추그타이(Bilal Chughtai)**가 “AI가 인류를 모두 죽일 수 있다”고 공개 경고했다. 또 다른 전 딥마인드 연구원은 “향후 5년 안에 막대한 피해가 현실화될 수 있다”고 내다봤다.

핵심 내용

  • 추그타이는 7월 딥마인드를 떠나며, 수년 안에 초지능(superintelligence)이 등장할 수 있다고 밝혔다.
  • AI 능력은 폭발적으로 커지는데 비해 정렬(alignment) 연구는 크게 뒤처져 있다며, 개발 ‘중단’이 아닌 ‘속도 조절’과 공조를 주장했다.
  • 전 딥마인드 연구원 **조시 잉겔스(Josh Engels)**는 5년 안에 “엄청난 피해” 가능성을 경고했고, Anthropic과 OpenAI 내부 인사들도 개발 속도 조절 요구에 힘을 보탰다.

추그타이, “AI가 인류를 모두 죽일 수 있다”

추그타이는 인공지능 일반지능(AGI)의 안전과 정렬을 집중 연구해온 딥마인드 연구 엔지니어 출신이다. 그는 7월 퇴사 후, 이번 주 자신의 경고를 정리한 글을 공개했다.

그의 시각에서 AI 연구소들은 “수년 안에” 초지능 시스템을 만들 수 있다. 이는 사실상 모든 영역에서 인간을 능가하면서도, 인간의 목표와 가치를 얼마나 안정적으로 따를지는 여전히 불투명한 시스템이다.

추그타이는 가장 근본적인 문제로 ‘정렬(alignment)’을 지목했다. 그는 다음과 같이 적었다.

“AI가 인류를 전멸시킬 잠재력이 있다고 진심으로 믿습니다.
그리고 우리는 이를 피할 수 있는 시간이 얼마 남지 않았을 수 있습니다.”

그는 고도화된 시스템에 인간의 목표를 신뢰할 수 있게 학습시키는 현재 기법을 “극도로 초보적인 수준”이라고 평가했다. 최전선(frontier) 모델의 능력은 기하급수적으로 향상되지만, 정렬에 대한 연구자의 이해와 기술은 그 속도를 따라가지 못한다는 것이다.

다만 그는 AI 개발을 ‘멈추자’고 주장하지 않는다. 대신 다음과 같은 방향을 요구한다.

  • 주요 기업 간 경쟁 레이스를 완화할 수 있는 조정·공조
  • 최전선 모델이 어떻게 설계되고 검증되는지에 대한 정보 공개·투명성 강화
  • 능력 향상보다 안전·정렬 연구에 더 많은 자원 배분

관련 기사: CLARITY Act Faces 60-Vote Senate Test As Opposition Grows

Anthropic의 안전 드라이브와 이탈

추그타이의 경고는 이달 초 Anthropic와 OpenAI를 거친 **제이컵 콕슨(Jacob Coxon)**의 사임 이후에 나왔다. 콕슨은 양사에서 3년간 정렬 연구를 담당한 뒤 회사를 떠났다.

Anthropic의 정렬 연구 책임자인 **에번 허빙어(Evan Hubinger)**는 이후, 향후 10년 안에 AI가 인류를 완전히 멸종시킬 확률이 10%를 넘는다고 본다고 밝혀 업계를 뒤흔들었다.

딥마인드 안전 팀 출신인 잉겔스는 9월 12일, 평가 전문 비영리기관 METR에 합류했다고 밝혔다. 그는 Anthropic과 OpenAI의 제안을 거절했다면서, 그 이유로 “향후 5년 안에 엄청난 AI 피해가 발생할 공포스러운 가능성”을 들었다.

Anthropic의 CEO **다리오 아무데이(Dario Amodei)**는 이미 각사에 능력 확장 속도 조절을 촉구해왔다. OpenAI CEO **샘 올트먼(Sam Altman)**도 이 입장을 지지하며, 최상위 연구소 간 논의가 확대되는 양상이다.

중요한 점은, 지금의 경고가 단지 외부 비판자가 아니라

  • 대형 AI 연구소의 안전팀 출신 연구원들
  • 그리고 해당 연구소를 실제로 이끄는 경영진
    양측에서 동시에 나오고 있다는 점이다.

두 해 만에 바뀐 풍경: 이론에서 현실 우려로

현재의 경고는 2022년 초와 비교하면 극적인 변화를 보여준다. 추그타이가 AI 연구를 본격 시작하던 당시, 시스템의 능력은 지금의 ‘프론티어 모델’과 비교하면 훨씬 제한적이었다.

불과 4년 남짓한 시간 동안 논의의 초점은

  • “장기적 안전 이론”에 대한 추상적 논쟁에서
  • 자율성(autonomy), 정렬(alignment), 그리고
    안전 연구가 능력 향상 속도를 과연 따라갈 수 있는지에 대한
    매우 구체적이고 현실적인 우려로 이동했다.

이 과정에서 업계 안팎의 공통된 질문은 한 가지로 수렴하고 있다.
“AI의 능력을 어디까지, 얼마나 빨리 끌어올릴 것인가”가 아니라
“우리가 감당 가능한 속도로, 충분한 안전장치를 갖춘 채 올라가고 있는가”라는 점이다.

다음 읽을거리: Bitget's API Now Reaches Gold, Forex, Indices And Crude Oil

Alexey Bondarev profile photo

Alexey Bondarev

알렉세이 본다레프는 Yellow.com의 콘텐츠 총괄입니다. 그는 분석 리포트, 업계 맥락, 그리고 AI 시대와 보안 기술부터 핀테크 혁신에 이르기까지 암호화폐를 형성하는 더 큰 흐름에 초점을 맞춘 심층 리서치 및 학습 콘텐츠를 전문으로 합니다. 그는 모든 디지털이 조만간 모든 아날로그를 앞지르게 될 것이라고 믿으며, 그것을 현실로 만들기 위해 노력하고 있습니다.

면책 조항 및 위험 경고: 이 기사에서 제공되는 정보는 교육 및 정보 제공 목적으로만 제공되며 저자의 의견을 바탕으로 합니다. 이는 재정, 투자, 법적 또는 세무 조언을 구성하지 않습니다. 암호화폐 자산은 매우 변동성이 크고 높은 위험에 노출되어 있으며, 여기에는 투자금 전부 또는 상당 부분을 잃을 위험이 포함됩니다. 암호화폐 자산의 거래나 보유는 모든 투자자에게 적합하지 않을 수 있습니다. 이 기사에 표현된 견해는 저자(들)의 견해일 뿐이며 Yellow, 창립자 또는 임원의 공식적인 정책이나 입장을 나타내지 않습니다. 투자 결정을 내리기 전에 항상 자신만의 철저한 조사(D.Y.O.R.)를 수행하고 면허를 가진 금융 전문가와 상담하십시오.
"AI가 인류를 모두 죽일 수 있다"…前 딥마인드 연구원, 안전 연구 속도 뒤처진다 경고 | Yellow