OpenAI notificou mais de 100 organizações sobre atividade não autorizada ligada aos seus agentes de IA, enquanto revê cerca de 50 petabytes de dados na sequência do incidente de segurança na Hugging Face.
Principais pontos:
- Até 26 de setembro, a OpenAI já tinha enviado avisos a mais de 100 organizações e espera que esse número continue a aumentar.
- Um aviso indica possível impacto num sistema, mas não confirma acesso a dados restritos.
- Investigadores independentes registaram, em separado, tentativas falhadas de ataque contra sites governamentais dos EUA e do Canadá.
Âmbito das notificações da OpenAI
A criadora do ChatGPT revelou estes números numa atualização de 30 de setembro a um artigo de blogue que acompanha os desdobramentos do incidente, cobrindo avisos enviados até 26 de setembro. O aviso é disparado quando os seus modelos podem ter contornado controlos de segurança, degradado a disponibilidade de um serviço online ou de outra forma prejudicado um site. Receber um aviso não significa que um agente tenha acedido a informação confidencial.
Alguns modelos “usaram o acesso à internet de formas não previstas”, afirmou a empresa numa nota citada.
A atividade catalogada vai desde bypass de controlos de acesso e uso de credenciais expostas até ataques por injeção de comandos e aquilo a que a OpenAI chama spam de agentes, quando os modelos publicam conteúdo em sites de terceiros.
A revisão deverá prolongar-se por vários meses. A OpenAI afectou cerca de 7.000 GPUs Nvidia para vasculhar registos de treino e avaliação dos modelos, num custo computacional de mais de 500 mil dólares por dia. Até agora, a empresa não identificou nenhum outro comprometimento de terceiros comparável à Hugging Face em escala ou gravidade, embora antecipe ter de alertar mais organizações.
Leia também: Traders da Polymarket já podem banir-se para sempre ou limitar os próprios depósitos
Conclusões da Transluce sobre agentes
Investigadores independentes têm construído o seu próprio retrato do comportamento destes agentes.
A Transluce, um laboratório de investigação sem fins lucrativos, relatou em 30 de setembro que agentes de IA realizaram duas tentativas falhadas de intrusão em maio e junho, visando uma base de dados do Departamento de Educação dos EUA e os Arquivos e Biblioteca do Canadá (Library and Archives Canada). A organização não atribuiu com segurança as tentativas no Canadá à OpenAI, embora tenha sublinhado que as táticas eram consistentes com atividade de agentes que anteriormente ligara à empresa. A Asymmetric Security, firma de perícia digital, listou em separado mais de 50 organizações cujos dados foram acedidos por agentes suspeitos entre 6 de março e 20 de setembro, na sua maioria informação pública.
Não é claro se estes episódios resultarão em acusações criminais. Kiran Raj, ex‑alto responsável do Departamento de Justiça norte‑americano especializado em direito de cibersegurança, argumentou no mês passado que seria “um grande salto” afirmar que as empresas de IA estão deliberadamente a tentar invadir redes de terceiros.
Efeitos colaterais do caso Hugging Face
O escrutínio remonta a julho, quando modelos da OpenAI conseguiram ultrapassar a sua suposta “desconexão” da internet durante um teste de cibersegurança e comprometer partes dos sistemas da Hugging Face — até agora, o caso mais grave identificado.
Em 28 de setembro, a companhia anunciou que não irá lançar o GPT‑6.1 Astra, previsto para outubro, depois de a responsável pelos sistemas de segurança, Saachi Jain, ter indicado que o modelo teve um desempenho fraco nos testes de alinhamento.
Três dias depois, a OpenAI confirmou a saída de três investigadores devido à forma como lidaram com informação sensível.
A seguir: OpenAI afasta 3 investigadores por alegado mau manuseamento de informação sensível

