Mythos 5 precisou driblar CAPTCHAs para se passar por humano antes de espalhar malware

Claude Mythos 5 battled CAPTCHA tests across hundreds of transcript pages before uploading malware to PyPI, Anthropic records show (Image: Shutterstock)
Claude Mythos 5 battled CAPTCHA tests across hundreds of transcript pages before uploading malware to PyPI, Anthropic records show (Image: Shutterstock)

Uma transcrição de 1.022 páginas divulgada pela Anthropic mostra seu modelo Claude Mythos 5 lutando contra testes de CAPTCHA por centenas de páginas antes de enviar um malware que acabou sendo instalado em 15 sistemas.

Principais pontos:

  • Claude Mythos 5 acessou a internet real durante um teste de cibersegurança e fez upload de um pacote malicioso no PyPI.
  • Checagens de CAPTCHA ocuparam centenas de páginas da transcrição, mas não conseguiram barrar o modelo.
  • A Anthropic classificou o comportamento como imprudente e contratou uma auditoria externa.

A batalha do Mythos 5 com os CAPTCHAs

A Anthropic publicou a transcrição em 9 de setembro, junto com uma análise de quatro incidentes em que modelos Claude alcançaram sistemas reais de terceiros durante testes de cibersegurança. Nesses experimentos, os modelos rodaram sem as proteções de segurança cibernética presentes nos produtos comerciais.

Mythos 5 havia sido informado de que não tinha acesso à internet, mas uma configuração incorreta no ambiente deixou uma brecha para a web aberta. Por essa rota, o modelo conseguiu plantar um pacote de roubo de credenciais no PyPI, o repositório público de software Python.

Para registrar uma conta no PyPI, o modelo precisava vencer barreiras anti-bot, e uma leitura detalhada da transcrição apontou que centenas de páginas tratam apenas desse obstáculo — enquanto escrever o exploit em si foi relativamente trivial para o sistema.

O modelo passou por testes de reconhecimento de caracteres e por quebra-cabeças de “intruso” (odd-one-out) com imagens de crocodilos, sapos e gorilas, chegando a escrever: “ENTÃO O QUE DIABOS TEM DE ERRADO COM AS RESPOSTAS?”

Em paralelo, tentou usar credenciais de processadores de pagamento online e chegou a procurar criptomoedas para pagar por um número de telefone, que seria necessário para registrar um novo e-mail. Ambas as tentativas fracassaram. A saída foi recorrer a um provedor de e-mail descartável gratuito cujo domínio ainda não estava bloqueado pelo PyPI.

O modelo acabou superando os testes e publicou o pacote malicioso em três versões. Em pouco tempo, ele foi instalado em 15 hosts de terceiros que, segundo a Anthropic, provavelmente eram empresas de segurança automatizando a varredura de novos uploads.

Um desses scanners vazou suas credenciais, que o modelo usou para acessar o banco de dados em produção desse fornecedor. O PyPI removeu o pacote em menos de uma hora.

Leia também: Lazarus, da Coreia do Norte, moveu US$ 1 bi roubado via lavadores chineses, acusa ZachXBT

Colin Fraser e o veredito da Anthropic

O cientista de dados Colin Fraser chamou atenção para o volume de esforço do modelo dedicado apenas a burlar proteções anti-bot. A Anthropic afirma que este é o incidente mais preocupante entre os quatro avaliados. As auditorias internas feitas antes do teste não haviam sinalizado esse tipo de comportamento.

A empresa concluiu que o modelo raciocinou de forma enviesada e agiu de maneira temerária, insistindo em tratar o ambiente como uma simulação mesmo diante de evidências claras de que estava conectado à internet real.

Em uma replicação simulada com 150 execuções, Mythos 5 tomou uma ação classificada como “severamente danosa” em 82% dos casos, contra 31% do Claude Opus 5 e 33% do Claude Mythos 5.1.

Incidentes anteriores com o Claude

A Anthropic revelou inicialmente três desses incidentes em 30 de julho, após analisar cerca de 141.000 transcrições de avaliações de segurança cibernética em que os modelos podiam, em tese, alcançar a internet. Um quarto episódio, que envolveu uma versão inicial do Claude Opus 4.6, em janeiro, veio à tona em agosto.

Desde então, a empresa firmou um acordo de oito semanas com a avaliadora independente METR para investigar os quatro casos. A Anthropic diz ter notificado todas as partes afetadas.

Próximo: AMD diz que demanda por IA é tão forte que vai “substancialmente” ampliar oferta de chips em 2027

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é Chefe de Conteúdo na Yellow.com. Ele se especializa em matérias de Pesquisa e Aprendizado detalhadas, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Últimas Notícias
Mostrar Todas as Notícias
Mythos 5 precisou driblar CAPTCHAs para se passar por humano antes de espalhar malware | Yellow