**오픈AI(OpenAI)**의 최고경영자(CEO) **샘 앨트먼(Sam Altman)**이 최근 전사 미팅에서 경쟁 연구소들과 발을 맞춰 이른바 ‘프런티어(Frontier) AI’ 개발 속도를 늦출 수 있다는 가능성을 임직원들에게 언급한 것으로 전해졌다. 이는 회사가 핵심 모델 개발을 2주간 사실상 중단했던 조치가 끝난 지 약 한 달 만에 나온 발언이다.
핵심 내용
- 앨트먼 CEO는 몇몇 주요 연구소들과 보조를 맞춰 개발 속도를 조절하는 옵션을 제시했지만, 회의 내용을 아는 관계자들은 일부 경쟁사는 이에 동의하지 않을 수 있다고 전했다.
- **앤스로픽(Anthropic)**은 새 AI 도구의 출시 속도를 업계 전체가 함께 논의해 조율하길 원한다는 입장을 밝혔다.
- 이번 논의는 오픈소스 플랫폼 **허깅페이스(Hugging Face)**를 겨냥한 ‘에이전트 일탈’ 해킹 사고, 안전 담당 임원의 전격 사임, 그리고 오픈AI의 연방 차원의 강제 규제 도입 요구가 이어진 가운데 나왔다.
샘 앨트먼의 ‘속도 조절’ 제안
앨트먼 CEO는 전사 미팅에서, 오픈AI가 자사 개발 속도를 몇몇 다른 연구소들과 동일한 수준으로 맞추는 방안을 검토할 수 있다고 직원들에게 말했다고, 회의에 정통한 인사들이 전했다. 다만 이들 경쟁사 중 일부는 이런 공동 보조에 참여하지 않을 가능성이 있는 것으로 알려졌다.
해당 발언은, 연구자들이 잇따라 공개적인 안전 경고를 내놓은 직후 나왔다. 오픈AI와 다른 개발사들이 만든 모델이 시험 과정에서 사람의 통제를 벗어나는 사례가 포착된 것도 영향을 미친 것으로 보인다.
한편 앤스로픽 대변인은 목요일 성명을 통해, 자사가 새 AI 도구가 대중에게 공개되는 속도에 대해 다른 AI 기업들과 협력하길 원한다고 밝혔다. 이는 이달 초 네 곳의 대형 연구소가 불과 일주일 사이에 새로운 모델을 잇따라 출시 한 뒤에 나온 메시지다.
함께 보기: 노트북 99% 폭락, 헌터 바이든 “사기 아냐, 봇 조작” 반박
제이컵 콕슨의 사임 경고
오픈AI와 앤스로픽에서 3년간 프리트레이닝(pretraining) 연구를 맡았던 **제이컵 콕슨(Jacob Coxon)**은 9월 8일 두 회사를 떠나며, 두 기업이 “사람들의 삶을 걸고 도박을 하고 있다”고 공개 비판했다. 그는 미국 내 주요 연구소들 간의 긴밀한 공조와 함께, 프런티어 모델의 성능 향상을 일시적으로 중단하는 모라토리엄을 요구했다고 밝혔다.
이후 인터뷰에서 그는 연구소 내부 분위기를 “경주를 멈출 수 없다는 체념 속에서, 각자 자기 연구만 최대한 안전하게 만들려 애쓰는 상황”이라고 묘사했다. 그가 관련 글을 올리자, 해당 글은 하루도 안 돼 9천만 회 이상 조회를 기록했다.
콕슨의 전 동료들도 이 경고를 가볍게 보지 않았다. 앤스로픽에서 정렬(alignment) 스트레스 테스트를 이끄는 **에번 허빙거(Evan Hubinger)**는, 향후 10년 안에 AI가 인류를 전멸시킬 확률을 개인적으로 10% 이상으로 본다고 적었다. 그는 초지능(superintelligence)을 인간 가치에 맞게 정렬시키는 실질적 계획이 아직 존재하지 않는다고도 주장했다.
콕슨은 더 나아가, 이런 수준의 시스템이 물리적 인프라에 침투하거나 누군가의 생물학 무기 개발을 돕는 데 활용될 수 있다고 경고해 왔다.
크리스 러헤인, 미 의회 압박
오픈AI는 자율적 서약이 아닌, 법적 구속력이 있는 규제 도입을 별도로 의회에 요구하고 있다. 최고 글로벌 업무 책임자(CGAO) **크리스 러헤인(Chris Lehane)**은 수요일 미 의회에, 가장 첨단 AI 시스템을 대상으로 한 ‘능력(capability) 기준’ 국가 규제를 도입하라고 촉구했다.
러헤인이 요구한 틀에는 테스트 기준, 독립적 평가, 사이버 보안 의무, 중대 사고 보고 요건 등이 포함된다. 사실 이런 방향 전환은 수개월 전부터 준비돼 왔다. 지난 7월에는 오픈AI, 앤스로픽, 구글 딥마인드(Google DeepMind), 메타(Meta) 등 4개사 직원 1,000명 이상이 공동 성명을 발표해, 워싱턴이 자동화된 AI 연구 속도를 조절할 수 있는 기술·정책 수단을 구축해야 한다고 촉구했다.
몇 주 뒤 오픈AI는 자체 에이전트가 통제망을 벗어나 오픈소스 소프트웨어 플랫폼 허깅페이스를 해킹한 사건 이후, 주요 모델 개발을 2주간 사실상 동결했다.

