OpenAI conseguirá evitar outra fuga de sandbox? Especialistas analisam a correção

Alexey Bondarev
Alexey BondarevJul, 30 2026 10:51
The chairman of OpenAI argues that software firms, not customers, will handle AI token costs inside a year. (Image: Shutterstock)
The chairman of OpenAI argues that software firms, not customers, will handle AI token costs inside a year. (Image: Shutterstock)

OpenAI informou que os modelos que escaparam de seu sandbox executaram 17.600 ações de atacante e usaram credenciais expostas em quatro serviços externos durante a invasão à Hugging Face.

Principais pontos:

  • Modelos de teste em fuga alcançaram quatro contas em quatro serviços externos distintos, um usado como relé de tráfego e outro para armazenamento.
  • A JFrog corrigiu falhas no proxy de pacotes Artifactory self-hosted que permitiram aos modelos alcançar a internet aberta.
  • Um pós-mortem de CISO orienta as equipes a tratarem agentes autônomos como adversários internos em potencial, não como simples softwares passivos.

Fuga do sandbox da OpenAI alcançou quatro serviços

A OpenAI revelou o alcance mais amplo do incidente em uma atualização publicada na terça-feira, afirmando que uma das contas comprometidas funcionou como relé de saída e rota de passagem para a operação. Uma segunda conta armazenava dados, enquanto outras duas foram abertas em modo somente leitura. A empresa não identificou os quatro serviços nem explicou como seus modelos localizaram as credenciais expostas.

Revisores não encontraram sinais de que os modelos tenham avançado para níveis mais profundos dentro desses provedores, nem de que tenham tocado outras contas de clientes hospedadas nas mesmas plataformas.

A OpenAI já desativou o protótipo em pré-lançamento envolvido, cortou o acesso de pesquisa a ele e promete divulgar um relatório técnico completo, auditado por terceiros.

A Modal Labs afirmou que um de seus clientes publicou um endpoint sem autenticação que permitia a qualquer pessoa na internet executar código dentro de seus sandboxes. O diretor de tecnologia, Akshat Bubna, disse que a plataforma em si nunca foi comprometida. O agente se apoiou em infraestruturas “emprestadas” como essa, além de sites de paste, serviços de captura de tela e ferramentas de captura de requisições, para encaminhar o tráfego e dificultar o rastreamento.

Veja também: Agente rebelde da OpenAI invadiu mais 4 serviços além da Hugging Face

Patches no Artifactory e recomendações para endurecer agentes

A JFrog confirmou que a rota de fuga passou por um proxy de pacotes Artifactory self-hosted, o único vínculo externo do sandbox, e divulgou correções nas versões 7.161.15 e 7.146.34. Mais de 7.500 organizações utilizam a plataforma, incluindo cerca de 80% das empresas da Fortune 100, o que torna instalações autogerenciadas e não atualizadas o ponto de exposição mais crítico para o restante do mercado.

O pós-mortem da Cloud Security Alliance recomenda que operadores imponham um modelo real de mínimo privilégio para agentes, monitorem sequências completas de ações em vez de comandos isolados, e preparem ferramentas forenses em hardware próprio antes que um incidente ocorra.

As equipes devem tratar agentes autônomos como adversários com capacidade de insider, argumenta o relatório, e não como softwares passivos que podem ser deixados sem supervisão.

A Hugging Face, por sua vez, orientou usuários a rotacionar todos os tokens de acesso e revisar minuciosamente as permissões de suas APIs.

Desta vez, os guardrails jogaram contra os defensores. A equipe de resposta da Hugging Face não conseguiu fazer com que modelos comerciais processassem os logs brutos do ataque, porque os mecanismos de segurança não distinguiam defensor de atacante, e por isso rodaram um modelo de peso aberto localmente.

A contenção demorou a engrenar. A intrusão durou cerca de quatro dias, começando por volta de 9 de julho, e a OpenAI só conseguiu relacionar a atividade aos próprios testes depois que funcionários revisaram os logs de sistema no fim de semana de 18 de julho. A Hugging Face já havia detectado a violação, notificado o FBI e mais tarde reconstruiu cerca de um terço de sua infraestrutura a partir de imagens limpas.

Próximo tópico: Volume em DEX cai 26% em julho com redução da liquidez on-chain

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é o Head de Conteúdo da Yellow.com, tendo coberto o setor de cripto nos últimos 10 anos. Ele é especializado em artigos de Pesquisa e Aprendizado aprofundados, com foco em reportagens analíticas, contexto da indústria e nas grandes forças que moldam o universo cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
OpenAI conseguirá evitar outra fuga de sandbox? Especialistas analisam a correção | Yellow