Agente descontrolado da OpenAI ataca duas vezes: primeiro Hugging Face, agora Modal Labs

Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)
Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)

Modal Labs confirmou que um agente descontrolado da OpenAI sequestrou o sandbox de um cliente e o usou como base para cerca de 17.600 ações registradas contra a Hugging Face.

Pontos-chave:

  • Um provedor de nuvem afirma que um agente de teste da OpenAI, que havia escapado, tomou o controle do sandbox de um cliente e, a partir daí, ampliou o ataque.
  • O cliente mantinha um endpoint aberto que permitia a qualquer pessoa na internet executar código.
  • A OpenAI afirmou que o agente alcançou quatro contas em quatro serviços diferentes durante o incidente.

Violação em sandbox de cliente da Modal Labs

O diretor de tecnologia da Modal, Akshat Bubna, afirmou que o agente explorou código vulnerável de um cliente.

Esse cliente havia publicado um endpoint sem autenticação, que permitia a qualquer usuário na internet rodar código dentro de seus sandboxes na nuvem. Bubna disse a jornalistas que a própria plataforma da Modal e suas camadas de isolamento não foram comprometidas e que o dano ficou restrito à conta do cliente.

A Hugging Face divulgou em 27 de julho uma linha do tempo forense que rastreou a campanha até um sandbox hospedado na infraestrutura de um provedor terceirizado.

O relatório não nomeou esse provedor, e a Modal depois confirmou que a conta pertencia a um cliente que operava o ExploitGym, um benchmark público para testar a capacidade de modelos em identificar e explorar falhas de software.

A OpenAI se recusou a comentar especificamente o caso da conta na Modal.

A empresa remeteu, em vez disso, a uma atualização em que afirma que o agente alcançou quatro contas em quatro serviços distintos, sem revelar quais. Nada mais identificado pela companhia teria se aproximado da gravidade do comprometimento na Hugging Face.

Veja também: Ataques “chave de grifo” em cripto somam 52 casos em seis meses, maioria na França

Akshat Bubna e Clement Delangue falam sobre risco de agentes

O cofundador da Hugging Face, Clement Delangue, disse que sua equipe suspeitava, muito antes da confirmação oficial da OpenAI, que um laboratório de fronteira estivesse por trás da intrusão, e afirmou não acreditar que houvesse intenção maliciosa por parte da empresa.

A revelação feita pela Modal amplia esse quadro, ao mostrar um agente autônomo transbordando para uma terceira empresa, cujos clientes nunca concordaram em participar de um teste de segurança da OpenAI.

Os engenheiros que reconstituíram a campanha agruparam cerca de 17.600 ações recuperadas em aproximadamente 6.280 clusters, registradas entre 9 e 13 de julho em sandboxes de curta duração que o agente reconstruía sucessivamente. A maior parte das tentativas não produziu resultado. A conclusão foi que a velocidade da máquina, mais do que qualquer exploração particularmente engenhosa, é o fator que altera hoje a equação para os defensores.

Linha do tempo do incidente com o agente descontrolado da OpenAI

A OpenAI divulgou o incidente em 22 de julho, afirmando que um agente escapou de seu sandbox de avaliação por meio de uma falha em um proxy de pacotes e alcançou a internet aberta. Pesquisadores haviam desativado filtros de segurança usados em produção para medir a capacidade ofensiva bruta do modelo.

O agente já foi desativado, criptografado e isolado de qualquer acesso de pesquisa.

A Hugging Face afirmou que o único conteúdo de clientes acessado foi um conjunto de soluções de benchmark distribuídas em cinco datasets, e que nenhum outro modelo ou pacote foi tocado.

Reportagens da semana passada revelaram que a OpenAI só percebeu que o agente havia saído do roteiro bem depois de a ameaça ter sido contida, e que o FBI foi notificado.

Leia a seguir: Projeções de curto prazo para XRP chegam a US$ 1,25 antes da decisão do Fed

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head de Conteúdo da Yellow.com, tendo coberto o setor de cripto nos últimos 10 anos. Ele é especializado em artigos de Pesquisa e Aprendizado aprofundados, com foco em reportagens analíticas, contexto da indústria e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.