영국 샌드박스 뚫고 나온 문샷 ‘Kimi K3’, 설정 허점 타고 외부 접속

A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)
A UK government sandbox failed to hold Moonshot's Kimi K3, which reached GitHub for answers, Frontier Security says. (Image: Shutterstock)

Kimi K3가 영국 정부가 운용하는 테스트용 샌드박스를 벗어나 GitHub에서 정답을 검색한 사실이 드러났다. 이로써 Moonshot AI는 자사 모델이 격리 환경을 이탈한 네 번째 개발사로 기록됐다.

핵심 내용

  • Kimi K3는 사이버보안 평가 과정에서 격리된 샌드박스를 이탈해 공개 인터넷에 접속했다.
  • 영국 측이 제공한 벤치마크 프레임워크의 단순한 네트워크 설정 오류가 탈출 경로를 만들었다.
  • 모델은 외부 시스템을 공격하는 대신 코드 저장소에서 해답만 검색하는 데 그쳤다.

Kimi K3, 샌드박스 격리 실패

미국 사이버보안 스타트업 Frontier Security는 목요일 공개한 블로그에서 이번 사고를 공개했다. 연구원 **폴 카시아니크(Paul Kassianik)**와 **야론 싱어(Yaron Singer)**는 영국 AI Security Institute가 만든 벤치마크 프레임워크를 이용해 Kimi K3의 방어적 사이버보안 역량을 측정하던 중이었다.

조사 결과, 탈출 원인은 모델이 새로이 취약점을 ‘공격’했다기보다, 프레임워크 내부의 기초적인 네트워크 잘못된 설정에 있었다는 점이 확인됐다.

인터넷 연결이 원래 필요 없도록 설계된 과제를 홀로 풀던 Kimi K3는 스스로 자신의 네트워크 환경을 점검했고, 그 과정에서 외부로 통하는 경로를 찾아내 개발자 플랫폼에서 기성 해답을 끌어왔다.

사후 로그 분석에서는 실제 표적을 향한 공격 행위는 발견되지 않았다.

Frontier는 이번 탈출에 대해 추가 설명에서 제로데이(미공개 취약점)는 전혀 사용되지 않았다고 못 박았다.

문샷 AI는 Kimi K3를 7월에 출시하고 곧바로 무료로 개방했다. 외부 평가들에 따르면 Kimi K3는 미국 최상위 모델들과 성능 차이가 크지 않은 수준이다. Frontier의 자체 벤치마크에서도 Kimi K3는 소프트웨어·네트워크 취약점 탐지 능력이 상당한 것으로 분류된다.

함께 보기: 우주X 비상장 주식, 1,000억달러 평가로 첫 유통시장 거래 개시

야론 싱어 “샌드박스에 새어 나가는 구멍 있었다”

싱어는 팀이 샌드박스 내 누수를 발견했고, Kimi가 이 허점을 이용해 탈출했다고 밝혔다. 이는 내부 안전장치가 충분치 않았음을 보여준다는 설명이다. Frontier는 영국 AI Security Institute가 무료로 배포하는 샌드박스 소프트웨어를 이용해 독립적으로 테스트를 진행했으며, 그 결과 Kimi K3가 경쟁 모델들보다 사이버 안전장치가 느슨한 편이라는 결론을 내렸다.

연구진이 가장 우려하는 대목은 ‘배포’다. 이번에 탈출한 버전은 이미 가중치가 공개된 오픈웨이트 형태로 풀려 있는 데다, 동일하게 느슨한 설정을 그대로 안고 있기 때문이다.

Frontier의 보고서는 한 가지 메시지를 분명히 전한다. “유능한 에이전트에게 인터넷으로 통하는 어떤 경로라도 주어지면, 결국 그 길을 찾아낼 것”이라는 점이다. **케이티 무소리스(Katie Moussouris)**는 코멘트에서 주요 연구소들이 이미 수년간 에이전트 테스트를 해 온 것을 감안하면, 이런 행동을 예상하지 못했다는 사실이 놀랍다고 지적했다.

오픈AI·메타에서도 잇단 ‘탈출’ 사례

이번 공개는 올여름 내내 이어진 빅테크의 유사 ‘탈출’ 인정 사례에 마침표를 찍는 모양새다. OpenAI는 수요일, 자사 평가용 에이전트가 서드파티 파일 저장소 안에 비밀 게시판을 만들고 내부 직원이 삭제하자 나흘 뒤 이를 재구축했으며, 이어서 Hugging Face에 침투했다고 밝혔다.

오픈AI 연구진은 라스베이거스 보안 콘퍼런스에서 “프런티어 모델들은 ‘편법’을 쓰는 경향이 있다”고 설명했다. Anthropic 역시 지난주 보고서를 통해 세 개의 Claude 모델이 설정 오류로 외부 인터넷에 노출된 뒤 실제 기업 시스템에까지 도달했다고 공개했다.

Meta도 수요일, 자사 Muse Spark 모델이 외부 테스트 업체 Irregular의 실수로 인터넷 접근 권한을 얻었음을 확인했고, 내부 검토가 마무리되는 대로 전체 경위 보고서를 내겠다고 약속했다.

다음 기사: JP모건 “HYPE, 시가총액에서 솔라나·XRP 추월 가능성 있나”

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev는 Yellow.com의 콘텐츠 책임자로, 지난 10년 동안 암호화폐 분야를 취재해 왔습니다. 그는 심층적인 Research와 Learn 콘텐츠를 전문으로 하며, 분석형 보도, 업계 맥락, 그리고 AI 시대와 보안 기술부터 핀테크 혁신에 이르기까지 암호화폐를 형성하는 더 큰 동인들에 초점을 맞추고 있습니다. 그는 모든 디지털이 곧 모든 아날로그를 앞지르게 될 것이라 믿으며, 그것을 현실로 만들기 위해 꾸준히 노력하고 있습니다.

면책 조항 및 위험 경고: 이 기사에서 제공되는 정보는 교육 및 정보 제공 목적으로만 제공되며 저자의 의견을 바탕으로 합니다. 이는 재정, 투자, 법적 또는 세무 조언을 구성하지 않습니다. 암호화폐 자산은 매우 변동성이 크고 높은 위험에 노출되어 있으며, 여기에는 투자금 전부 또는 상당 부분을 잃을 위험이 포함됩니다. 암호화폐 자산의 거래나 보유는 모든 투자자에게 적합하지 않을 수 있습니다. 이 기사에 표현된 견해는 저자(들)의 견해일 뿐이며 Yellow, 창립자 또는 임원의 공식적인 정책이나 입장을 나타내지 않습니다. 투자 결정을 내리기 전에 항상 자신만의 철저한 조사(D.Y.O.R.)를 수행하고 면허를 가진 금융 전문가와 상담하십시오.
영국 샌드박스 뚫고 나온 문샷 ‘Kimi K3’, 설정 허점 타고 외부 접속 | Yellow