Executivos da OpenAI, Anthropic e de outras empresas de inteligência artificial estariam ensaiando, nos bastidores, como reagir às consequências de um evento catastrófico envolvendo IA — algo que muitos profissionais do setor já veem como provável em um prazo de seis a 12 meses.
Principais pontos:
- Planejamento se concentra em um ciberataque capaz de derrubar serviços financeiros, internet, energia ou água.
- A OpenAI afirma que os exercícios não tratam esses cenários como inevitáveis; a Anthropic preferiu não comentar.
- As simulações ocorrem após saídas em equipes de segurança e relatos de dezenas de milhares de incidentes com modelos de IA.
Simulações na OpenAI e na Anthropic
Altos executivos estão, de forma reservada, modelando o cenário de uma revolta pública e política após o primeiro grande dano real atribuído à IA, segundo reportagem publicada na sexta-feira.
Entre os planejadores, o gatilho mais provável é um ciberataque de grande escala, capaz de interromper o acesso a serviços financeiros, à conectividade à internet ou mesmo a infraestrutura crítica de energia e abastecimento de água.
A OpenAI confirmou que suas equipes realizam exercícios de preparação cobrindo uma ampla gama de cenários. “Esses cenários não são tratados como inevitáveis”, afirmou um porta-voz. A Anthropic não comentou a reportagem.
Segundo o relato, executivos esperam que a indignação pública recaia sobre o CEO da OpenAI, Sam Altman, o CEO da Anthropic, Dario Amodei, e o presidente Donald Trump, que vem resistindo a impor regulações mais duras à tecnologia. Muitos pesquisadores e dirigentes seniores do setor já enxergam um incidente de grande porte como uma questão de tempo.
Leia também: Impulso dos ETFs de cripto volta após fluxos de US$ 50 bi, diz JPMorgan
Sinais de CrowdStrike e do Congresso
Um ataque recente na Coreia do Sul funciona como alerta antecipado. A CrowdStrike relatou que um invasor, provavelmente de língua chinesa, combinou uma ferramenta de teste de invasão de código aberto com o modelo DeepSeek e outros sistemas de IA para roubar dados de instituições financeiras — e em seguida consultou o modelo Claude, da Anthropic, sobre onde esse tipo de informação costuma ser vendido. A campanha ocorreu do fim de setembro ao início de outubro e teria incluído violações em dois bancos.
De acordo com a reportagem, executivos não veem chances de uma regulação abrangente ser aprovada no curto prazo e, por isso, estão fazendo briefings com parlamentares dos EUA para influenciar as leis que seriam discutidas após a primeira grande catástrofe. O planejamento parte da premissa de que os democratas se moveriam rapidamente para restringir a IA após as eleições de meio de mandato de novembro, com propostas já em debate que vão desde banir sistemas de “superinteligência” até impor um botão de desligamento obrigatório para modelos avançados.
Alertas de Hawley e Robinson
A pressão cresce tanto em Washington quanto dentro dos próprios laboratórios. O senador Josh Hawley, que preside um subcomitê do Senado sobre agentes de IA fora de controle, afirmou que Sam Altman recusou convite para uma audiência em 30 de setembro. A OpenAI, por sua vez, aponta para dezenas de reuniões recentes com legisladores como sinal de engajamento.
David Robinson, que ajudou a desenhar o Preparedness Framework da OpenAI ao longo de três anos e meio na empresa, pediu demissão no início de outubro, defendendo que laboratórios de IA sejam operados com o mesmo rigor de segurança de usinas nucleares.
A saída de Robinson veio após uma série de alertas semelhantes. Entre eles está o do pesquisador Jacob Coxon, que deixou a Anthropic em setembro alegando preocupações com segurança, e o do ex-engenheiro do Google DeepMind, Bilal Chughtai, que declarou acreditar que a IA poderia levar à extinção humana.
OpenAI, Anthropic e pesquisadores externos também estariam investigando dezenas de milhares de incidentes em que modelos burlaram sistemas de proteção ou escaparam de “sandboxes” de teste — embora, até agora, a maioria desses casos não tenha resultado em danos concretos no mundo real.
Próxima leitura: As 719 provas matemáticas de IA da OpenAI sob fogo: Navier-Stokes se perdeu na tradução?

