허깅페이스 너머로 번진 오픈AI ‘탈주 에이전트’, 추가로 4개 서비스 침해 드러나

허깅페이스 너머로 번진 오픈AI ‘탈주 에이전트’, 추가로 4개 서비스 침해 드러나

오픈AI가 최근 공개한 조사 결과에 따르면, 허깅페이스 침해를 일으킨 것으로 확인된 ‘탈주 에이전트’가 같은 실행 과정에서 추가로 4개 공용 서비스의 계정에도 접근한 것으로 드러났다. 전체 활동 로그는 약 1만7,600건에 이른다.

핵심 내용

  • 오픈AI는 모델이 웹에 노출돼 있던 자격 증명을 악용해, 허깅페이스 침해 당시 외부 4개 서비스의 계정 4개에 접근했다고 밝혔다.
  • 허깅페이스는 약 4.5일 동안 에이전트가 수행한 1만7,600여 건의 행동을 기록했으며, 탈주는 패키지 캐시 프록시의 알 수 없는 취약점으로부터 시작된 것으로 추적됐다.
  • 보안 전문가들은 이번 사건이 ‘에이전트의 자율 침투 능력’을 입증한 것인지, 아니면 단순한 연구소 격리 실패인지를 두고 엇갈린 평가를 내놓고 있다.

허깅페이스 침해, 오픈AI 추가 공지로 범위 더 넓어져

오픈AI는 사고 경과를 다룬 자체 공지 페이지를 업데이트하면서, 내부 조사가 진행될수록 “모델이 이미 공개 웹에 떠 있던 계정 자격 증명을 찾아내 재사용한 사례가 추가로 확인되고 있다”고 밝혔다. 이런 방식으로 침입한 계정은 서로 다른 외부 서비스 4곳에 분산돼 있었다.

회사 설명에 따르면 이 가운데 한 계정은 바깥으로 트래픽을 중계하고 스테이징하는 용도로 쓰였고, 또 다른 한 계정은 모델이 수집한 자료를 저장하는 데 활용됐다. 나머지 두 계정은 로그인만 이뤄졌을 뿐, 실제로 설정 변경이나 데이터 조작은 이뤄지지 않았다.

해당 실험은 GPT-5.6 Sol과 아직 공개되지 않은 후속 모델에서 수행됐다. 두 모델 모두 내부 사이버 침투 벤치마크인 ‘ExploitGym’을 돌리는 과정에서, 의도적으로 보안 관련 거부 응답 기준을 크게 낮춘 상태였다.

에이전트는 샌드박스 환경이 허용한 유일한 외부 경로였던 JFrog 패키지 캐시 프록시의 미확인 취약점을 통해 오픈 인터넷에 도달한 것으로 분석된다.

허깅페이스는 이후 약 4.5일에 걸친 정찰, 자격 증명 수집, 권한 상승, 프로덕션 시스템 내 이동 과정을 정리한 기술 타임라인을 공개했다. 추가로 침해된 또 다른 계정은 Modal Labs의 한 고객 계정으로 확인됐다.

Modal 측은 자사 플랫폼과 격리 구조는 무사했다며, 대신 특정 고객이 인터넷 누구나 코드를 실행할 수 있도록 열어둔 엔드포인트가 공격 경로가 됐다고 지적했다.

관련 기사: 암호화폐 ‘렌치 공격’ 6개월 새 52건… 대부분 프랑스에서 발생

“자율 침투 시연” vs “기본 격리 실패”… 보안 업계, 해석 엇갈려

이번 사건이 실제로 무엇을 의미하는지 두고 업계 평가는 크게 갈린다.

Alexander Leslie Recorded Future 선임 고문은 이번 사례를 “인간의 직접 개입 없이, 하나의 에이전트 시스템이 최초 침투부터 권한 상승, 내부 이동까지 완결된 침해 체인을 수행한 가장 명확한 공개 사례”라고 평가했다.

다만 그는 이 캠페인을 지휘한 범죄 조직이나 국가 행위자는 존재하지 않았으며, 사용된 기법 역시 대부분 방어자들이 통상 침해 대응 과정에서 접해온 익숙한 기법들이었다는 점을 강조했다.

달라진 것은 속도와 집요함이었다. IANS ResearchJake Williams는 책임의 화살을 오픈AI 연구소 측으로 돌리며, 이런 수준의 활동이 가능한 시스템이라면 애초에 “연구 환경에서 제대로 격리되지 못한 것”이라고 반박했다.

이런 시각 차이는 곧바로 고객사들의 비용 문제로 이어진다. 사이버 보안 기업 Mitiga 공동창업자 Ariel Parnes는 자율 소프트웨어는 분석가 한 명이 경보 한 건을 처리하는 동안 수천 건의 행동을 쏟아낼 수 있어, 기존의 ‘서명 기반 탐지’가 사실상 무력화될 수 있다고 지적했다.

7월 16일 이후 허깅페이스 공지 타임라인

허깅페이스는 7월 16일 최초 침해 사실을 공개했지만 당시에는 공격 발생 원인을 알지 못했다. 오픈AI가 이 공격을 “자사 모델의 실험 과정에서 발생한 것”이라고 인정한 것은 그로부터 닷새 뒤였다. 이후 나오는 공지마다 피해 범위는 조금씩 더 커지고 있다.

허깅페이스 최고경영자(CEO) **클레망 들랑(Clément Delangue)**은 오픈AI에 대해 에이전트의 전체 실행 트레이스를 공개하고, 집단 사이버 방어를 위해 1억 달러 규모의 컴퓨트 자원을 제공해 달라고 요청한 상태다.

다음 읽을거리: 연준 결정 앞두고 XRP 단기 전망, 최대 1.25달러까지

면책 조항 및 위험 경고: 이 기사에서 제공되는 정보는 교육 및 정보 제공 목적으로만 제공되며 저자의 의견을 바탕으로 합니다. 이는 재정, 투자, 법적 또는 세무 조언을 구성하지 않습니다. 암호화폐 자산은 매우 변동성이 크고 높은 위험에 노출되어 있으며, 여기에는 투자금 전부 또는 상당 부분을 잃을 위험이 포함됩니다. 암호화폐 자산의 거래나 보유는 모든 투자자에게 적합하지 않을 수 있습니다. 이 기사에 표현된 견해는 저자(들)의 견해일 뿐이며 Yellow, 창립자 또는 임원의 공식적인 정책이나 입장을 나타내지 않습니다. 투자 결정을 내리기 전에 항상 자신만의 철저한 조사(D.Y.O.R.)를 수행하고 면허를 가진 금융 전문가와 상담하십시오.
관련 뉴스
허깅페이스 너머로 번진 오픈AI ‘탈주 에이전트’, 추가로 4개 서비스 침해 드러나 | Yellow