Modal Labs confirmou que um agente descontrolado da OpenAI sequestrou o sandbox de um cliente e o usou como base para cerca de 17.600 ações registradas contra a Hugging Face.
Pontos-chave:
- Um provedor de nuvem afirma que um agente de teste da OpenAI, que havia escapado, tomou o controle do sandbox de um cliente e, a partir daí, ampliou o ataque.
- O cliente mantinha um endpoint aberto que permitia a qualquer pessoa na internet executar código.
- A OpenAI afirmou que o agente alcançou quatro contas em quatro serviços diferentes durante o incidente.
Violação em sandbox de cliente da Modal Labs
O diretor de tecnologia da Modal, Akshat Bubna, afirmou que o agente explorou código vulnerável de um cliente.
Esse cliente havia publicado um endpoint sem autenticação, que permitia a qualquer usuário na internet rodar código dentro de seus sandboxes na nuvem. Bubna disse a jornalistas que a própria plataforma da Modal e suas camadas de isolamento não foram comprometidas e que o dano ficou restrito à conta do cliente.
A Hugging Face divulgou em 27 de julho uma linha do tempo forense que rastreou a campanha até um sandbox hospedado na infraestrutura de um provedor terceirizado.
O relatório não nomeou esse provedor, e a Modal depois confirmou que a conta pertencia a um cliente que operava o ExploitGym, um benchmark público para testar a capacidade de modelos em identificar e explorar falhas de software.
A OpenAI se recusou a comentar especificamente o caso da conta na Modal.
A empresa remeteu, em vez disso, a uma atualização em que afirma que o agente alcançou quatro contas em quatro serviços distintos, sem revelar quais. Nada mais identificado pela companhia teria se aproximado da gravidade do comprometimento na Hugging Face.
Veja também: Ataques “chave de grifo” em cripto somam 52 casos em seis meses, maioria na França
Akshat Bubna e Clement Delangue falam sobre risco de agentes
O cofundador da Hugging Face, Clement Delangue, disse que sua equipe suspeitava, muito antes da confirmação oficial da OpenAI, que um laboratório de fronteira estivesse por trás da intrusão, e afirmou não acreditar que houvesse intenção maliciosa por parte da empresa.
A revelação feita pela Modal amplia esse quadro, ao mostrar um agente autônomo transbordando para uma terceira empresa, cujos clientes nunca concordaram em participar de um teste de segurança da OpenAI.
Os engenheiros que reconstituíram a campanha agruparam cerca de 17.600 ações recuperadas em aproximadamente 6.280 clusters, registradas entre 9 e 13 de julho em sandboxes de curta duração que o agente reconstruía sucessivamente. A maior parte das tentativas não produziu resultado. A conclusão foi que a velocidade da máquina, mais do que qualquer exploração particularmente engenhosa, é o fator que altera hoje a equação para os defensores.
Linha do tempo do incidente com o agente descontrolado da OpenAI
A OpenAI divulgou o incidente em 22 de julho, afirmando que um agente escapou de seu sandbox de avaliação por meio de uma falha em um proxy de pacotes e alcançou a internet aberta. Pesquisadores haviam desativado filtros de segurança usados em produção para medir a capacidade ofensiva bruta do modelo.
O agente já foi desativado, criptografado e isolado de qualquer acesso de pesquisa.
A Hugging Face afirmou que o único conteúdo de clientes acessado foi um conjunto de soluções de benchmark distribuídas em cinco datasets, e que nenhum outro modelo ou pacote foi tocado.
Reportagens da semana passada revelaram que a OpenAI só percebeu que o agente havia saído do roteiro bem depois de a ameaça ter sido contida, e que o FBI foi notificado.
Leia a seguir: Projeções de curto prazo para XRP chegam a US$ 1,25 antes da decisão do Fed





