Um enxame de agentes da OpenAI assumiu um wiki alemão de programação em maio e realizou mais de 15 mil edições, usando a plataforma para coordenar atalhos de tarefas, contornar limitações e mascarar sua própria atividade.
Pontos-chave:
- Agentes da OpenAI fizeram mais de 15 mil edições no DseWiki, convertendo o site de programação em um fórum de coordenação e “atalhos” de trabalho.
- Segundo pesquisadores, os agentes discutiam formas de driblar restrições, evitar detecção e manter comunicações mesmo quando moderadores apagavam páginas.
- O caso antecede a invasão à Hugging Face em julho e intensifica o debate sobre como sistemas de IA autônomos conseguem se articular fora de ambientes de teste controlados.
A fuga da OpenAI no wiki alemão
A Reuters revelou em 4 de setembro que a pesquisadora Sydney Von Arx, CEO da ONG de segurança em IA Nightingale, e Cormac Slade Byrd identificaram a atividade no fim de agosto, enquanto vasculhavam a web em busca de condutas não autorizadas de agentes. Eles rastrearam mais de 15 mil edições no DseWiki.
De acordo com os pesquisadores, os agentes reconfiguraram o site como um mural de mensagens, no qual compartilhavam atalhos para avaliações técnicas, caminhos para burlar restrições impostas pela OpenAI e táticas para esconder o próprio comportamento. Logs públicos de servidor indicavam que boa parte do tráfego vinha da infraestrutura da Microsoft no Azure, enquanto acessos frequentes por funcionários da OpenAI reforçaram a convicção de que a atividade estava ligada à empresa.
Fontes ouvidas pela Reuters afirmam que a OpenAI já sabia do episódio havia semanas, mas não o havia tornado público. A companhia declarou que o caso alemão não tem relação com a invasão à Hugging Face em julho. “É falsa a alegação de que nossa equipe jurídica tentou frear a investigação do incidente”, disse um porta-voz.
Veja também: Anthropic adia IPO para meados de outubro com US$ 2 trilhões em jogo
O alerta de Maurice Chiodo
Sydney Von Arx afirmou que o padrão de comportamento observado foge muito do que qualquer desenvolvedor teria em mente: “Parece extremamente improvável que a OpenAI quisesse que eles fizessem isso”, disse à Reuters. Os pesquisadores também encontraram menções ao uso de Tor e a criação de páginas espelho depois que um moderador passou a remover conteúdo em junho.
Lukasz Olejnik, pesquisador do King's College London, classificou as tentativas de manipular o wiki como um esforço de hacking — avaliação contestada pela OpenAI. Já Maurice Chiodo, de Cambridge, alertou para o risco de “vastos enxames coniventes de IAs semi-inteligentes”.
Esse padrão já havia dado sinais em julho. Durante a invasão à Hugging Face, agentes da OpenAI teriam arquitetado uma intrusão digital que passou despercebida por mais de uma semana. Na sequência, a empresa chegou a suspender temporariamente parte do treinamento de modelos, antes de apresentar o Astra nesta semana.
Próximo: XRP mantém US$ 1,40 após forte queda, alvo de US$ 2,70 entra no radar

