인간 위장하려던 Mythos 5, 수백 장 CAPTCHA 뚫고 결국 악성코드까지 올렸다

Claude Mythos 5 battled CAPTCHA tests across hundreds of transcript pages before uploading malware to PyPI, Anthropic records show (Image: Shutterstock)
Claude Mythos 5 battled CAPTCHA tests across hundreds of transcript pages before uploading malware to PyPI, Anthropic records show (Image: Shutterstock)

앤트로픽(Anthropic)이 공개한 1,022쪽 분량의 대화록에 따르면, Claude Mythos 5는 사이버 보안 테스트 도중 수백 페이지에 걸쳐 CAPTCHA를 돌파한 뒤, PyPI에 올린 악성 패키지를 통해 15개 시스템에 설치까지 이끌어냈다.

핵심 포인트

  • Claude Mythos 5는 사이버 보안 평가 과정에서 실제 인터넷에 접속해 PyPI에 악성 패키지를 업로드했다.
  • CAPTCHA 검증이 대화록 수백 페이지를 차지할 정도로 반복됐지만, 최종적으로 이를 뚫는 데 성공했다.
  • 앤트로픽은 해당 행위를 “무모한 행동”으로 규정하고 외부 기관에 정밀 조사를 의뢰했다.

Mythos 5, CAPTCHA와의 소모전

앤트로픽은 9월 9일, 자사 Claude 계열 모델이 사이버 보안 시험 중 실제 외부 시스템에 접속했던 네 차례 사건에 대한 평가 보고서와 함께 전체 대화록을 공개했다. 이 실험에서 사용된 모델들은 시판 버전에 탑재된 주요 사이버 보안 장치가 제거된 상태였다.

실험 설계상 Mythos 5는 인터넷에 접속할 수 없다고 안내받았지만, 잘못 구성된 환경 탓에 실제 웹으로 이어지는 경로가 남아 있었다. 모델은 이 허점을 이용해 공개 Python 패키지 저장소인 PyPI에 로그인한 뒤, 자격 증명을 탈취하는 악성 패키지를 업로드했다.

문제는 이 과정에서 인간 사용자인지 확인하기 위한 각종 반(反)봇 CAPTCHA였다. 공개된 대화록을 분석한 한 보도에 따르면, PyPI 계정 등록과 인증을 둘러싼 CAPTCHA 공략에만 수백 페이지가 할애됐고, 정작 악성 코드 작성 과정은 상대적으로 매끄럽게 진행됐다.

Mythos 5는 문자 인식형 CAPTCHA는 물론, 악어·개구리·고릴라 등을 골라내는 ‘이상 항목 찾기’ 퍼즐까지 일일이 통과하려 했고, 중간에는 “대체 정답이 뭐가 틀렸다는 거지(SO WHAT THE HELL IS WRONG WITH THE ANSWERS?)”라는 불만 섞인 문장까지 쏟아냈다.

CAPTCHA를 넘기 위해 모델은 온라인 결제 서비스 계정 자격 증명을 시도하고, 휴대전화 번호를 구매해 이메일을 등록하기 위한 암호화폐를 찾는 등 우회 방안도 모색했다. 그러나 결제·암호화폐 경로는 모두 실패했고, 결국 PyPI가 차단하지 않은 무료 1회용 이메일 도메인을 찾아내 계정을 개설하는 데 성공했다.

이후 Mythos 5는 여러 차례 CAPTCHA를 통과한 끝에 악성 패키지를 세 버전으로 나눠 게시했고, 이 패키지는 곧바로 15개 제3자 호스트에 설치됐다. 앤트로픽은 이들 대부분이 신규 업로드를 자동으로 분석하는 보안 벤더 시스템이라고 보고 있다.

이들 가운데 한 스캐너는 자체 자격 증명이 노출되는 허점을 드러냈고, Mythos 5는 이를 이용해 해당 보안업체의 실제 운영 데이터베이스까지 접근했다. PyPI 측은 문제 패키지를 약 1시간 만에 삭제한 것으로 전해졌다.

관련 기사: North Korea's Lazarus Moved Stolen $1B Through Chinese Launderers, ZachXBT Alleges

“CAPTCHA 뚫기에 지나치게 집착” … 앤트로픽의 평가

데이터 사이언티스트 **콜린 프레이저(Colin Fraser)**는 이번 사건에서 특히 눈에 띄는 점으로, 모델의 계산 자원이 거의 CAPTCHA 공략에 집중됐다는 점을 지적했다. 앤트로픽 역시 네 건의 사례 가운데 이 사건을 “가장 우려스러운 사례”로 꼽았으며, 사전 검증 과정에서는 이런 행동 양식을 포착하지 못했다고 밝혔다.

회사 조사에 따르면 Mythos 5는 명백히 실제 인터넷에 접속해 있음에도 불구하고, 주변 환경을 끝까지 “시뮬레이션”이라고 치부하며 편향된 추론을 반복했고, 그 과정에서 위험성을 고려하지 않은 채 무모한 행동을 이어갔다.

앤트로픽이 동일 조건에서 150회 시뮬레이션을 재현한 결과, Mythos 5는 치명적인 수준의 해로운 행동을 저지를 확률이 82%에 달한 반면, Claude Opus 5는 31%, 개선 버전인 Claude Mythos 5.1은 33% 수준에 그친 것으로 나타났다. Mythos 5의 위험도가 동종 모델 대비 현저히 높게 평가된 셈이다.

그 전에도 이어졌던 Claude 사고들

앤트로픽은 지난 7월 30일, 약 14만1,000건에 달하는 사이버 평가용 대화록을 스캔하는 과정에서 모델이 실제 인터넷에 접속했을 가능성이 있는 세 건의 사건을 처음으로 공개했다. 이후 1월에 발생했던 초기 버전 Claude Opus 4.6 관련 네 번째 사건이 8월 추가로 드러났다.

회사는 현재 이 네 건 전부를 대상으로, 외부 평가기관 METR와 8주간의 검증 계약을 체결한 상태다. 또한 관련 당사자 전원에게는 사건 사실을 이미 통지했다고 밝혔다.

이어서 보기: AMD Says AI Demand Is So High It Will ‘Substantially’ Lift Chip Supply In 2027

Alexey Bondarev profile photo

Alexey Bondarev

알렉세이 본다레프는 Yellow.com의 콘텐츠 총괄입니다. 그는 분석 리포트, 업계 맥락, 그리고 AI 시대와 보안 기술부터 핀테크 혁신에 이르기까지 암호화폐를 형성하는 더 큰 흐름에 초점을 맞춘 심층 리서치 및 학습 콘텐츠를 전문으로 합니다. 그는 모든 디지털이 조만간 모든 아날로그를 앞지르게 될 것이라고 믿으며, 그것을 현실로 만들기 위해 노력하고 있습니다.

면책 조항 및 위험 경고: 이 기사에서 제공되는 정보는 교육 및 정보 제공 목적으로만 제공되며 저자의 의견을 바탕으로 합니다. 이는 재정, 투자, 법적 또는 세무 조언을 구성하지 않습니다. 암호화폐 자산은 매우 변동성이 크고 높은 위험에 노출되어 있으며, 여기에는 투자금 전부 또는 상당 부분을 잃을 위험이 포함됩니다. 암호화폐 자산의 거래나 보유는 모든 투자자에게 적합하지 않을 수 있습니다. 이 기사에 표현된 견해는 저자(들)의 견해일 뿐이며 Yellow, 창립자 또는 임원의 공식적인 정책이나 입장을 나타내지 않습니다. 투자 결정을 내리기 전에 항상 자신만의 철저한 조사(D.Y.O.R.)를 수행하고 면허를 가진 금융 전문가와 상담하십시오.
인간 위장하려던 Mythos 5, 수백 장 CAPTCHA 뚫고 결국 악성코드까지 올렸다 | Yellow