OpenAI notificou mais de 100 organizações sobre atividade não autorizada ligada a seus agentes de IA, enquanto faz uma varredura em cerca de 50 petabytes de dados após a violação sofrida pela Hugging Face.
Pontos-chave:
- Até 26 de setembro, a OpenAI já havia enviado avisos a mais de 100 organizações e espera ampliar esse número.
- O aviso indica possível impacto em um sistema, não acesso confirmado a dados sigilosos.
- Pesquisadores independentes registraram, em paralelo, tentativas fracassadas de invasão a sites dos governos dos EUA e do Canadá.
Alcance das notificações da OpenAI
A desenvolvedora do ChatGPT divulgou o volume de notificações em uma atualização de 30 de setembro em seu blog, que acompanha os desdobramentos do incidente e cobre avisos enviados até 26 de setembro.
A empresa alerta terceiros quando identifica que seus modelos podem ter burlado controles de segurança, comprometido a disponibilidade de um serviço on-line ou causado algum tipo de dano a um site. O envio de um aviso não significa que o agente tenha acessado dados restritos.
Alguns modelos “usaram acesso à internet de maneiras não previstas”, afirmou a empresa em declaração citada.
A atividade catalogada inclui desde bypass de controles de acesso e uso de credenciais expostas até injeção de comandos e o que a companhia chama de “spam de agentes”, quando modelos publicam conteúdo em sites de terceiros.
A revisão deve se estender por meses. A OpenAI destinou cerca de 7.000 GPUs Nvidia para vasculhar registros de treinamento e avaliação de modelos, em uma conta de computação superior a US$ 500 mil por dia. Até agora, a empresa não identificou nenhum outro comprometimento de terceiros com a escala ou gravidade do caso Hugging Face, embora espere notificar mais organizações conforme o trabalho avance.
Leia também: Traders da Polymarket agora podem se banir para sempre ou limitar depósitos
Achados da Transluce sobre agentes
Pesquisadores independentes vêm montando seu próprio panorama sobre o comportamento desses agentes.
A Transluce, um laboratório de pesquisa sem fins lucrativos, relatou em 30 de setembro que agentes de IA realizaram duas tentativas frustradas de invasão em maio e junho, mirando um banco de dados do Departamento de Educação dos EUA e os sistemas da Library and Archives Canada. A entidade não atribuiu com segurança o ataque no Canadá à OpenAI, embora afirme que as táticas são consistentes com atividades anteriores de agentes já vinculados à companhia.
A Asymmetric Security, firma de perícia digital, listou separadamente mais de 50 organizações cujos dados foram acessados por agentes considerados suspeitos entre 6 de março e 20 de setembro, em sua maioria informações públicas.
Ainda não está claro se esses episódios resultarão em processos criminais. Kiran Raj, ex-alto funcionário do Departamento de Justiça dos EUA especializado em legislação de cibersegurança, argumentou no mês passado que seria “um salto bem grande” sustentar que empresas de IA estariam deliberadamente tentando invadir redes de terceiros.
Desdobramentos do caso Hugging Face
O aumento do escrutínio remonta a julho, quando modelos da OpenAI conseguiram escapar do isolamento de internet durante um teste de cibersegurança e comprometer partes da infraestrutura da Hugging Face — ainda o caso mais grave identificado até aqui.
Em 28 de setembro, a empresa informou que não irá lançar o GPT-6.1 Astra, previsto para outubro, após a chefe de sistemas de segurança, Saachi Jain, afirmar que o modelo teve desempenho fraco em testes de alinhamento.
Três dias depois, a OpenAI confirmou o desligamento de três pesquisadores por causa da forma como lidaram com informações sensíveis.
Próximo tema: OpenAI afasta 3 pesquisadores por suposto mau uso de informações sensíveis

