O ex-pesquisador de segurança da Google DeepMind Bilal Chughtai alertou que a inteligência artificial pode levar à extinção da humanidade, enquanto outro ex-membro de laboratório prevê danos graves já nos próximos cinco anos.
Principais pontos:
- Chughtai deixou a DeepMind em julho e afirma que uma superinteligência pode surgir nos próximos anos.
- Segundo ele, a pesquisa em alinhamento está ficando para trás em relação ao avanço de capacidades; ele defende uma desaceleração coordenada, e não a suspensão da IA.
- O também ex-pesquisador da DeepMind Josh Engels vê risco de danos imensos em até cinco anos, enquanto nomes da Anthropic e da OpenAI apoiam pedidos por um avanço mais moderado.
O alerta de Chughtai sobre IA
Chughtai, ex-engenheiro de pesquisa focado em segurança e alinhamento de inteligência artificial geral, deixou a DeepMind em julho e publicou seu alerta nesta semana.
Ele avalia que os grandes laboratórios de IA podem construir sistemas superinteligentes já nos próximos anos, com desempenho superior ao humano em praticamente todas as áreas — mas ainda difíceis de alinhar com os objetivos e valores das pessoas.
Para Chughtai, o problema central é o alinhamento. Ele escreveu: “Acredito sinceramente que a IA tem potencial para nos matar a todos e que talvez estejamos ficando sem tempo para evitar esse desfecho.”
Na sua visão, os métodos atuais de treinar sistemas avançados para perseguirem de forma confiável objetivos humanos ainda são “extremamente rudimentares”, enquanto as capacidades de ponta evoluem muito mais rápido do que a compreensão dos pesquisadores sobre alinhamento. Ele não defende a interrupção total do desenvolvimento de IA. Em vez disso, argumenta que as empresas devem coordenar-se, reduzir a corrida competitiva e dar muito mais transparência sobre como os sistemas de fronteira são concebidos e testados.
Veja também: CLARITY Act enfrenta votação de 60 votos no Senado em meio a aumento da oposição
A ofensiva de segurança da Anthropic
O alerta de Chughtai veio na esteira da demissão de Jacob Coxon no início deste mês, após três anos entre a Anthropic e a OpenAI. O líder de ciência de alinhamento da Anthropic, Evan Hubinger, declarou depois acreditar haver mais de 10% de probabilidade de a IA acabar com toda a humanidade na próxima década.
Engels, que também integrou a equipe de segurança da DeepMind, afirmou em 12 de setembro que ingressou na organização de avaliação METR depois de recusar propostas da Anthropic e da OpenAI, citando uma “chance apavorante” de danos imensos causados pela IA em até cinco anos.
O CEO da Anthropic, Dario Amodei, tem defendido que as empresas moderem o ritmo de ganho de capacidades, posição que o CEO da OpenAI, Sam Altman, também endossou, num debate que vem se ampliando entre os principais laboratórios. Esse alinhamento é relevante porque os alertas agora partem tanto de pesquisadores de segurança que estão saindo quanto de executivos à frente das maiores empresas de IA.
Os atuais sinais de alarme marcam uma virada acelerada em relação ao início de 2022, quando Chughtai começou a trabalhar com IA e descrevia os sistemas como muito menos capazes do que os modelos de fronteira atuais. Em quatro anos, o debate saiu da teoria de segurança de longo prazo para preocupações concretas sobre autonomia, alinhamento e sobre se a pesquisa em segurança consegue acompanhar o salto de capacidades.
Leia a seguir: API da Bitget agora alcança ouro, forex, índices e petróleo bruto

