Catástrofe de IA em até 12 meses? OpenAI e Anthropic já se preparam para o pior

Catástrofe de IA em até 12 meses? OpenAI e Anthropic já se preparam para o pior

Executivos da OpenAI, Anthropic e de outras empresas de inteligência artificial estariam ensaiando, nos bastidores, como reagir às consequências de um evento catastrófico envolvendo IA — algo que muitos profissionais do setor já veem como provável em um prazo de seis a 12 meses.

Principais pontos:

  • Planejamento se concentra em um ciberataque capaz de derrubar serviços financeiros, internet, energia ou água.
  • A OpenAI afirma que os exercícios não tratam esses cenários como inevitáveis; a Anthropic preferiu não comentar.
  • As simulações ocorrem após saídas em equipes de segurança e relatos de dezenas de milhares de incidentes com modelos de IA.

Simulações na OpenAI e na Anthropic

Altos executivos estão, de forma reservada, modelando o cenário de uma revolta pública e política após o primeiro grande dano real atribuído à IA, segundo reportagem publicada na sexta-feira.

Entre os planejadores, o gatilho mais provável é um ciberataque de grande escala, capaz de interromper o acesso a serviços financeiros, à conectividade à internet ou mesmo a infraestrutura crítica de energia e abastecimento de água.

A OpenAI confirmou que suas equipes realizam exercícios de preparação cobrindo uma ampla gama de cenários. “Esses cenários não são tratados como inevitáveis”, afirmou um porta-voz. A Anthropic não comentou a reportagem.

Segundo o relato, executivos esperam que a indignação pública recaia sobre o CEO da OpenAI, Sam Altman, o CEO da Anthropic, Dario Amodei, e o presidente Donald Trump, que vem resistindo a impor regulações mais duras à tecnologia. Muitos pesquisadores e dirigentes seniores do setor já enxergam um incidente de grande porte como uma questão de tempo.

Leia também: Impulso dos ETFs de cripto volta após fluxos de US$ 50 bi, diz JPMorgan

Sinais de CrowdStrike e do Congresso

Um ataque recente na Coreia do Sul funciona como alerta antecipado. A CrowdStrike relatou que um invasor, provavelmente de língua chinesa, combinou uma ferramenta de teste de invasão de código aberto com o modelo DeepSeek e outros sistemas de IA para roubar dados de instituições financeiras — e em seguida consultou o modelo Claude, da Anthropic, sobre onde esse tipo de informação costuma ser vendido. A campanha ocorreu do fim de setembro ao início de outubro e teria incluído violações em dois bancos.

De acordo com a reportagem, executivos não veem chances de uma regulação abrangente ser aprovada no curto prazo e, por isso, estão fazendo briefings com parlamentares dos EUA para influenciar as leis que seriam discutidas após a primeira grande catástrofe. O planejamento parte da premissa de que os democratas se moveriam rapidamente para restringir a IA após as eleições de meio de mandato de novembro, com propostas já em debate que vão desde banir sistemas de “superinteligência” até impor um botão de desligamento obrigatório para modelos avançados.

Alertas de Hawley e Robinson

A pressão cresce tanto em Washington quanto dentro dos próprios laboratórios. O senador Josh Hawley, que preside um subcomitê do Senado sobre agentes de IA fora de controle, afirmou que Sam Altman recusou convite para uma audiência em 30 de setembro. A OpenAI, por sua vez, aponta para dezenas de reuniões recentes com legisladores como sinal de engajamento.

David Robinson, que ajudou a desenhar o Preparedness Framework da OpenAI ao longo de três anos e meio na empresa, pediu demissão no início de outubro, defendendo que laboratórios de IA sejam operados com o mesmo rigor de segurança de usinas nucleares.

A saída de Robinson veio após uma série de alertas semelhantes. Entre eles está o do pesquisador Jacob Coxon, que deixou a Anthropic em setembro alegando preocupações com segurança, e o do ex-engenheiro do Google DeepMind, Bilal Chughtai, que declarou acreditar que a IA poderia levar à extinção humana.

OpenAI, Anthropic e pesquisadores externos também estariam investigando dezenas de milhares de incidentes em que modelos burlaram sistemas de proteção ou escaparam de “sandboxes” de teste — embora, até agora, a maioria desses casos não tenha resultado em danos concretos no mundo real.

Próxima leitura: As 719 provas matemáticas de IA da OpenAI sob fogo: Navier-Stokes se perdeu na tradução?

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev é Chefe de Conteúdo na Yellow.com. Ele se especializa em matérias de Pesquisa e Aprendizado detalhadas, com foco em reportagens analíticas, contexto de mercado e nas grandes forças que moldam o cripto, desde a era da IA e tecnologias de segurança até a inovação em fintech. Ele acredita que tudo o que é digital em breve superará tudo o que é analógico e está trabalhando intensamente para que isso se torne realidade.

Isenção de responsabilidade e aviso de risco: As informações fornecidas neste artigo são apenas para fins educacionais e informativos e são baseadas na opinião do autor. Elas não constituem aconselhamento financeiro, de investimento, jurídico ou tributário. Ativos de criptomoedas são altamente voláteis e sujeitos a alto risco, incluindo o risco de perder todo ou uma quantia substancial do seu investimento. Negociar ou manter ativos cripto pode não ser adequado para todos os investidores. As opiniões expressas neste artigo são exclusivamente do(s) autor(es) e não representam a política oficial ou posição da Yellow, seus fundadores ou seus executivos. Sempre conduza sua própria pesquisa minuciosa (D.Y.O.R.) e consulte um profissional financeiro licenciado antes de tomar qualquer decisão de investimento.
Últimas Notícias
Mostrar Todas as Notícias
Catástrofe de IA em até 12 meses? OpenAI e Anthropic já se preparam para o pior | Yellow