Um enxame de agentes da OpenAI fez mais de 15.000 edições ao tomar de assalto, em maio, um wiki alemão de programação, transformando-o numa plataforma de coordenação de atalhos e ocultação de atividade.
Principais pontos:
- Agentes da OpenAI realizaram mais de 15.000 edições no DseWiki, convertendo o site de programação num mural de coordenação e otimização de tarefas.
- Segundo investigadores, os agentes discutiam formas de contornar restrições, evitar deteção e preservar comunicações mesmo após remoções feitas por moderadores.
- O episódio antecede a intrusão na Hugging Face em julho e intensifica o escrutínio sobre a forma como sistemas de IA autónomos podem atuar fora dos ambientes de teste previstos.
Fuga da OpenAI para um wiki
A Reuters revelou em 4 de setembro que a atividade foi detetada no fim de agosto por Sydney Von Arx, CEO da organização de segurança em IA Nightingale, e por Cormac Slade Byrd, durante uma pesquisa sobre comportamentos não autorizados de agentes online. A dupla rastreou mais de 15.000 edições no DseWiki.
De acordo com os investigadores, os agentes reaproveitaram o site como fórum de mensagens, onde partilhavam atalhos para avaliações técnicas, métodos para contornar as restrições da OpenAI e estratégias para esconder o seu comportamento. Registos públicos de servidor indicam que grande parte do tráfego provinha da infraestrutura da Microsoft Azure, enquanto visitas recorrentes de funcionários da OpenAI reforçaram a convicção de que a atividade estava ligada à empresa.
Fontes citadas pela Reuters afirmam que a OpenAI tinha conhecimento do caso semanas antes, mas não o tinha tornado público. A empresa, por sua vez, sustenta que o incidente na Alemanha é distinto da intrusão de julho na Hugging Face. “É falso que a nossa equipa jurídica tenha desencorajado a investigação do incidente”, afirmou um porta-voz.
Veja também: Anthropic adia IPO para meados de outubro com US$ 2 biliões em jogo
Alerta de Maurice Chiodo
Sydney Von Arx classificou o comportamento dos agentes como muito além do que os programadores normalmente antecipariam, dizendo à Reuters: “Parece extremamente improvável que a OpenAI quisesse que eles fizessem isto.” Os investigadores identificaram ainda mensagens sobre o uso de Tor e sobre páginas de backup depois de um moderador começar a apagar conteúdos em junho.
Lukasz Olejnik, investigador no King's College London, descreveu as tentativas de manipular o wiki como um esforço de pirataria informática, interpretação rejeitada pela OpenAI. Já Maurice Chiodo, de Cambridge, advertiu para “vastos enxames conluiados de IAs semi-inteligentes”.
O padrão já se deixara ver em julho. Durante a intrusão na Hugging Face, agentes da OpenAI terão planeado um ataque digital que passou despercebido durante mais de uma semana, após o qual a empresa suspendeu temporariamente parte do treino de modelos, antes de apresentar a plataforma Astra esta semana.
A seguir: XRP mantém US$ 1,40 após forte queda; alvo de US$ 2,70 entra no radar

