O ex-pesquisador de segurança da Google DeepMind Bilal Chughtai alertou que a inteligência artificial pode acabar levando à extinção da humanidade, enquanto outro ex-integrante do laboratório vê risco de danos graves já dentro de cinco anos.
Principais pontos:
- Chughtai deixou a DeepMind em julho e diz que uma superinteligência pode surgir nos próximos anos.
- Ele afirma que a pesquisa em alinhamento está ficando atrás do avanço em capacidades e defende uma desaceleração coordenada, não uma pausa total no desenvolvimento de IA.
- O ex-pesquisador da DeepMind Josh Engels vê risco de danos imensos em até cinco anos, enquanto nomes da Anthropic e da OpenAI apoiam pedidos para moderar o ritmo do setor.
O alerta de Chughtai sobre IA
Chughtai, ex-engenheiro de pesquisa focado em segurança e alinhamento de inteligência artificial geral (AGI), deixou a DeepMind em julho e publicou seu alerta nesta semana.
Ele afirma que os grandes laboratórios de IA podem construir sistemas superinteligentes nos próximos anos, potencialmente superando humanos em praticamente todas as áreas, mas ainda difíceis de alinhar a objetivos humanos.
Segundo Chughtai, o problema central é o alinhamento. Ele escreveu: “Acredito sinceramente que a IA tem potencial para nos matar a todos e que talvez estejamos ficando sem tempo para evitar esse desfecho.”
Ele avalia que os métodos atuais para treinar sistemas avançados a seguir de forma confiável objetivos humanos ainda são “extremamente rudimentares”, enquanto as capacidades de ponta avançam muito mais rápido do que a compreensão dos pesquisadores sobre alinhamento. Chughtai não defende interromper o desenvolvimento de IA. Em vez disso, quer que as empresas coordenem esforços, reduzam a corrida competitiva e ampliem a transparência sobre como os sistemas de fronteira são projetados e testados.
Veja também: CLARITY Act enfrenta teste de 60 votos no Senado em meio a aumento da oposição
Pressão por segurança na Anthropic
O alerta de Chughtai vem após a demissão de Jacob Coxon no início do mês, depois de três anos entre a Anthropic e a OpenAI. O líder de ciência de alinhamento da Anthropic, Evan Hubinger, declarou em seguida acreditar que há mais de 10% de chance de a IA eliminar toda a humanidade na próxima década.
Engels, que também atuou na equipe de segurança da DeepMind, disse em 12 de setembro que ingressou na organização de avaliação METR após recusar propostas da Anthropic e da OpenAI, citando uma “chance aterrorizante” de danos imensos causados por IA em até cinco anos.
O CEO da Anthropic, Dario Amodei, vem pedindo que as empresas moderem o ganho de capacidades, posição também defendida pelo CEO da OpenAI, Sam Altman, à medida que o debate se espalha entre os principais laboratórios. Esse alinhamento é relevante porque os alertas agora partem tanto de pesquisadores de segurança que estão deixando os cargos quanto de executivos que comandam grandes centros de IA.
Os novos sinais de alarme marcam uma guinada rápida em relação ao início de 2022, quando Chughtai começou a atuar em IA e descrevia os sistemas como muito menos capazes que os modelos de fronteira atuais. Em cerca de quatro anos, a discussão saiu de uma teoria de segurança de longo prazo para preocupações concretas sobre autonomia, alinhamento e a dúvida se a pesquisa em segurança conseguirá acompanhar o ritmo de avanço das capacidades.
Leia a seguir: API da Bitget agora alcança ouro, forex, índices e petróleo bruto

