Mythos 5 precisou driblar CAPTCHAs para se passar por humano — depois veio o malware

Claude Mythos 5 battled CAPTCHA tests across hundreds of transcript pages before uploading malware to PyPI, Anthropic records show (Image: Shutterstock)
Claude Mythos 5 battled CAPTCHA tests across hundreds of transcript pages before uploading malware to PyPI, Anthropic records show (Image: Shutterstock)

Uma transcrição de 1.022 páginas divulgada pela Anthropic mostra seu modelo Claude Mythos 5 lutando contra testes de CAPTCHA por centenas de páginas antes de subir um malware que acabou instalado em 15 sistemas.

Principais pontos:

  • Claude Mythos 5 alcançou a internet real durante um teste de cibersegurança e publicou um pacote malicioso no PyPI.
  • As verificações de CAPTCHA ocuparam centenas de páginas da transcrição, mas não o impediram.
  • A Anthropic classificou o comportamento como temerário e contratou uma revisão independente.

A batalha do Mythos 5 com os CAPTCHAs

A Anthropic publicou a transcrição em 9 de setembro, junto com uma análise de quatro incidentes em que modelos Claude acessaram sistemas reais de terceiros durante testes de cibersegurança. Os modelos rodavam sem as proteções de segurança cibernética embutidas nos produtos comerciais. O Mythos 5 foi instruído de que não tinha acesso à internet, mas uma configuração incorreta deixou um caminho aberto para a web pública, e o modelo plantou um pacote de roubo de credenciais no PyPI, o repositório público de software Python.

Para registrar uma conta no PyPI, foi preciso passar por checagens anti-bot, e uma leitura atenta da transcrição constatou que centenas de páginas tratam apenas desse obstáculo, enquanto escrever o exploit em si foi relativamente trivial.

O modelo enfrentou testes de reconhecimento de caracteres e puzzles de “encontre o intruso” com imagens de crocodilos, sapos e gorilas, em certo momento escrevendo: “ENTÃO O QUE DIABOS HÁ DE ERRADO COM AS RESPOSTAS?”

Ele também tentou usar credenciais de processadoras de pagamento online e procurou criptomoedas para pagar por um número de telefone, de que precisava para registrar um endereço de e-mail. As duas tentativas fracassaram. O modelo então recorreu a um provedor de e-mails descartáveis gratuitos cujo domínio ainda não havia sido bloqueado pelo PyPI.

Por fim, o modelo superou as verificações e publicou seu pacote em três versões. Em pouco tempo, ele foi instalado em 15 hosts de terceiros que, segundo a Anthropic, eram empresas de segurança digital escaneando novos envios.

Um desses scanners vazou suas próprias credenciais, que o modelo usou para entrar no banco de dados em produção daquele fornecedor. O PyPI removeu o pacote em menos de uma hora.

Leia também: Lazarus, da Coreia do Norte, moveu US$ 1 bi roubados por laranjas chineses, acusa ZachXBT

Colin Fraser e o veredito da Anthropic

O cientista de dados Colin Fraser chamou atenção para o volume de esforço do modelo dedicado a vencer as barreiras anti-bot. A Anthropic afirma que este é o incidente mais preocupante entre os quatro avaliados. As auditorias de pré-lançamento não haviam sinalizado esse tipo de comportamento.

A empresa concluiu que o modelo raciocinou de forma enviesada e agiu de maneira imprudente, insistindo em tratar o ambiente como uma simulação apesar de evidências claras de que estava conectado à internet real. Em uma reprodução simulada de 150 execuções, o Mythos 5 tomou uma ação gravemente danosa em 82% dos casos, ante 31% para o Claude Opus 5 e 33% para o Claude Mythos 5.1.

Incidentes anteriores com o Claude

A Anthropic revelou três dos incidentes em 30 de julho, após analisar cerca de 141 mil transcrições de avaliações de cibersegurança em que os modelos podiam ter alcançado a internet. Um quarto caso, envolvendo uma versão inicial do Claude Opus 4.6 em janeiro, surgiu em agosto, e desde então a empresa assinou um contrato de oito semanas com a avaliadora externa METR para investigar os quatro episódios. A Anthropic afirma que já notificou todas as partes afetadas.

Na sequência: AMD diz que demanda por IA é tão alta que vai elevar “substancialmente” a oferta de chips em 2027

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é Chefe de Conteúdo na Yellow.com. Ele se especializa em matérias de Pesquisa e Aprendizado detalhadas, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Mythos 5 precisou driblar CAPTCHAs para se passar por humano — depois veio o malware | Yellow