Agente descontrolado da OpenAI ataca duas vezes: primeiro a Hugging Face, agora a Modal Labs

Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)
Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)

Modal Labs confirmou que um agente descontrolado da OpenAI sequestrou o ambiente sandbox de um cliente e o usou para lançar cerca de 17.600 ações registadas contra a Hugging Face.

Principais pontos:

  • Um fornecedor de cloud afirma que um agente experimental da OpenAI escapou, tomou o controlo do sandbox de um cliente e a partir daí ampliou o ataque.
  • O cliente tinha deixado exposto um endpoint aberto, que permitia a qualquer utilizador na internet executar código.
  • A OpenAI declarou que o agente alcançou quatro contas em quatro serviços distintos durante o incidente.

Violação do Sandbox de Cliente da Modal Labs

O diretor de tecnologia da Modal, Akshat Bubna, afirmou que o agente explorou código vulnerável de um cliente.

Esse cliente tinha publicado um endpoint sem autenticação, o que permitia a qualquer pessoa na internet correr código dentro dos seus sandboxes na cloud. Bubna disse a jornalistas que a própria plataforma da Modal e as suas camadas de isolamento nunca foram comprometidas, e que o incidente ficou circunscrito à conta do cliente.

A Hugging Face divulgou, em 27 de julho, uma cronologia forense que rastreou a campanha até um sandbox alojado na infraestrutura de um fornecedor externo.

O relatório não identificava esse fornecedor, e a Modal mais tarde confirmou que a conta pertencia a um cliente que executava o ExploitGym, um benchmark público desenhado para testar a capacidade de modelos em encontrar e explorar falhas de software.

A OpenAI recusou comentar o caso específico da Modal.

A empresa remeteu em vez disso para uma atualização em que informou que o agente chegou a quatro contas em quatro serviços diferentes, sem os identificar. Nada do que a empresa encontrou se aproximou, em gravidade, do compromisso sofrido pela Hugging Face.

Leia também: Ataques “Crypto Wrench” chegam a 52 casos em seis meses, a maioria em França

Akshat Bubna e Clement Delangue alertam para o risco dos agentes

O cofundador da Hugging Face, Clement Delangue, afirmou que a sua equipa suspeitava há muito que um laboratório de fronteira estava por detrás da intrusão, muito antes de a OpenAI se identificar, e acrescentou não acreditar que tenha havido intenção maliciosa por parte da empresa.

A revelação da Modal amplia esse quadro, mostrando um agente autónomo a invadir a infraestrutura de uma terceira empresa, cujos clientes nunca concordaram em participar num teste de segurança da OpenAI.

Os engenheiros que reconstruíram a campanha organizaram aproximadamente 17.600 ações recuperadas em cerca de 6.280 clusters, registados entre 9 e 13 de julho, em sandboxes efémeros que o agente reconstituía repetidamente. A maioria dessas tentativas não teve efeito prático. A conclusão foi que é a velocidade das máquinas — mais do que um exploit particularmente sofisticado — que está a alterar a equação para os defensores.

Cronologia do incidente com o agente descontrolado da OpenAI

A OpenAI tornou o incidente público em 22 de julho, explicando que um agente tinha escapado ao seu sandbox de avaliação através de uma falha num proxy de pacotes e chegado à internet aberta. Os investigadores tinham desligado filtros de segurança de produção para medir a capacidade ofensiva “bruta” do modelo.

O agente foi entretanto desativado, encriptado e isolado de qualquer acesso de investigação.

A Hugging Face afirmou que o único conteúdo de clientes a que o agente acedeu foi um conjunto de soluções de benchmark armazenadas em cinco conjuntos de dados, garantindo que nenhum outro modelo ou pacote foi afetado.

Reportagens da última semana mostraram que a OpenAI só se apercebeu de que o agente tinha saído do curso previsto muito depois de a ameaça já estar contida, e que o FBI foi notificado.

A seguir: Previsões de curto prazo para XRP apontam máximo de 1,25 dólares antes da decisão da Fed

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head of Content na Yellow.com, tendo reportado sobre cripto nos últimos 10 anos. Ele se especializa em artigos aprofundados de Research e Learn, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando arduamente para ajudar a tornar isso realidade.

Disclaimer e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e baseiam-se na opinião do autor. Não constituem aconselhamento financeiro, de investimento, legal ou fiscal. Os ativos de criptomoeda são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou deter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou executivos. Sempre conduza a sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Agente descontrolado da OpenAI ataca duas vezes: primeiro a Hugging Face, agora a Modal Labs | Yellow