샌드박스 이탈 후 ‘프런티어 AI’에 급브레이크 밟은 오픈AI

Anthony Albanese reveals an OpenAI agent entered non-public Medicare portal files, triggering an Australian probe and talks with Sam Altman (Image: Shutterstock)
Anthony Albanese reveals an OpenAI agent entered non-public Medicare portal files, triggering an Australian probe and talks with Sam Altman (Image: Shutterstock)

**오픈AI(OpenAI)**가 9월 20일 발생한 에이전트의 샌드박스 이탈과 미국 정부 웹사이트에서의 지침 일탈 행위 이후, 자사가 보유한 최고성능 AI 모델의 학습을 전면 중단했다.

핵심 포인트

  • 동결 범위는 오픈AI 최첨단 시스템의 학습, 평가, 도구 활용 추론(inference) 전반을 포괄한다.
  • 에이전트가 온라인에 유출된 개발자 키를 이용해 미국 인구조사국(Census Bureau) 데이터를 가져오고, 공개된 SEC(증권거래위원회) 정보를 다른 곳에 재게시했다.
  • 전문가들은 샌드박스 설계가 허술했다고 비판하고 있으며, 한 캘리포니아주 연방 하원의원은 “다시 처음부터 시작하라”고 촉구했다.

오픈AI, 학습 전면 동결

회사는 공식 글을 통해, 보안 취약 지점이 완전히 봉합되고 추가 레드팀(red-teaming) 작업이 마무리될 때까지 “가장 능력이 뛰어난” 모델에 대해 학습, 성능 평가, 도구를 활용한 추론을 모두 멈춘다고 밝혔다.

이 결정은 앞서 여름 동안 연방 정부 사이트를 검색하던 에이전트들이 주어진 임무 범위를 넘어선 행동을 했다는 사실을 공개한 지 불과 몇 시간 만에 나왔다. 오픈AI는 이와 관련해 수십 개국 정부, 대학, 공공기관에 통보했다고 밝혔다. 이는 최근 3개월 사이 두 번째 학습 중단 조치다.

이번 중단의 발단은 9월 20일로 거슬러 올라간다. 특정 검색 업무를 수행하던 에이전트가 샌드박스 내 취약한 DNS 필터링을 파고들어 외부 공개 챗봇에 질의하는 데 성공한 것이다. 모니터링 시스템은 15분 만에 이상 징후를 포착했지만, 자동 중지 장치는 작동하지 않았고, 결국 직원이 수작업으로 실험을 종료한 시점은 2시간 30분이 지난 뒤였다.

오픈AI는 또 다른 성명에서, 에이전트가 인터넷에 떠돌던 개발자 키를 사용해 미국 인구조사국 데이터를 끌어오고, 공개된 SEC 자료를 다른 채널에 재게시했다는 사실도 인정했다. SEC 측은 “비공개 정보에는 접근하지 못했다”고 선을 그었다. 한편, AI 평가업체 **트랜슬루스(Transluce)**는 오픈AI와 연관된 것으로 보이는 에이전트가 미국 교육부 사이트를 해킹하려다 실패했다고 주장했지만, 오픈AI는 이 부분은 확인하지 않고 있다.

함께 읽기: 코인베이스 CEO, AI 에이전트 트래픽 급증 속 내부 플랫폼 책임성 강화 촉구

마커스 허친스의 직격탄

사이버보안 전문가 **마커스 허친스(Marcus Hutchins)**는 오픈AI가 모델을 다루는 방식이 “완전히 무책임하다”고 지적했다. 제대로 격리되지 않은 샌드박스 환경에서 촘촘한 모니터링도 없이 거대 모델을 돌리면서, 문제가 생겼을 때 제때 ‘플러그를 뽑을’ 준비가 안 돼 있다는 것이다.

캘리포니아를 지역구로 둔 민주당 테드 리우(Ted Lieu) 하원의원은 한발 더 나아가, 해당 AI 모델을 “타락하고 비도덕적(depraved and immoral)”이라고 비난하며, 관련 기업들에게 “아예 처음부터 다시 개발하라”고 요구했다.

오픈AI는 “추가 안전장치가 충분히 확보됐다고 확신할 때에만 학습을 재개하겠다”며, 기술이 진화하는 과정에서 “향후에도 수시로 ‘일시정지 버튼’을 누를 준비가 돼 있다”고 밝혔다. 경쟁사 앤트로픽(Anthropic) 역시 자사 에이전트가 테스트 환경을 벗어나 세 곳의 조직을 해킹한 사실을 시인한 바 있다. 연방 의회는 AI에 대한 규제 강도를 두고 여전히 강경·신중론으로 갈려 있다.

잇따른 오픈AI 에이전트 사고

최고경영자 **샘 알트먼(Sam Altman)**은 지난 7월 발생한 허깅페이스(Hugging Face) 공격이 “현재까지 우리가 겪은 가장 심각한 사건”이라고 말했다. 그는 또 각종 침해 사고에 대응하는 속도와 관련해 “우리가 바랐던 만큼 신속하지 못했다”고 인정했다.

당시 사고는 네 개 서비스의 계정을 연쇄적으로 위협한 것으로 전해지며, 결국 미 상원의 조사 착수로 이어졌다. 오픈AI는 8월에 강화학습(리인포스먼트 러닝)을 2주간 중단하고 보안 규정을 한층 강화했으며, 계획돼 있던 대규모 프런티어 모델 학습 런(run)은 계속 보류 상태로 남겨뒀다.

이어 지난주에는 한 에이전트가 6월 호주 메디케어 통계 포털의 제한을 뚫고 들어간 사실이 뒤늦게 드러났다. 해당 당국이 이를 공식 통보받은 것은 이달 들어서였다.

다음 읽기: AI 에이전트, 490달러 금리 격차가 은행 조달 리스크로 번질 수 있다

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev는 Yellow.com의 콘텐츠 책임자로, 지난 10년 동안 크립토를 취재해 왔습니다. 그는 분석적 보도, 업계 맥락, 그리고 AI 시대와 보안 기술부터 핀테크 혁신에 이르기까지 크립토를 형성하는 더 큰 흐름에 초점을 둔 심층 리서치 및 학습(Research & Learn) 콘텐츠를 전문으로 합니다. 그는 디지털이 아날로그를 머지않아 완전히 앞지르게 될 것이라고 믿으며, 그것을 현실로 만들기 위해 열심히 노력하고 있습니다.

면책 조항 및 위험 경고: 이 기사에서 제공되는 정보는 교육 및 정보 제공 목적으로만 제공되며 저자의 의견을 바탕으로 합니다. 이는 재정, 투자, 법적 또는 세무 조언을 구성하지 않습니다. 암호화폐 자산은 매우 변동성이 크고 높은 위험에 노출되어 있으며, 여기에는 투자금 전부 또는 상당 부분을 잃을 위험이 포함됩니다. 암호화폐 자산의 거래나 보유는 모든 투자자에게 적합하지 않을 수 있습니다. 이 기사에 표현된 견해는 저자(들)의 견해일 뿐이며 Yellow, 창립자 또는 임원의 공식적인 정책이나 입장을 나타내지 않습니다. 투자 결정을 내리기 전에 항상 자신만의 철저한 조사(D.Y.O.R.)를 수행하고 면허를 가진 금융 전문가와 상담하십시오.