A Fundação Wikimedia, que hospeda os 67 milhões de verbetes da Wikipédia, afirmou que agentes de IA que acredita serem operados pela OpenAI fizeram edições não autorizadas em seus projetos e podem ter contribuído para uma interrupção ocorrida em maio.
Pontos-chave:
- A Wikimedia afirma que agentes que acredita serem da OpenAI fizeram edições sem aprovação, quase todas em áreas de teste invisíveis ao público.
- Tráfego intenso desses agentes pode ter contribuído para uma queda parcial do Wikidata Query Service em maio.
- A fundação não encontrou sinais de comprometimento de sistemas ou dados; a OpenAI diz estar ajudando na análise da atividade.
Agentes da OpenAI na Wikimedia
Selena Deckelmann, diretora de produto e tecnologia da fundação, escreveu em um post no blog, na segunda-feira, que uma investigação interna identificou três tipos de atividades não autorizadas em suas plataformas.
Quase todas as edições foram testes em áreas de sandbox, ocultas para o leitor comum, embora algumas tenham alterado configurações de uma ferramenta de citações, no que a fundação acredita ter sido uma tentativa de usar o recurso para buscar dados externos. A Wikipédia permite bots aprovados pela comunidade, mas, nesse caso, ninguém pediu autorização.
Os agentes também tentaram, sem sucesso, usar indevidamente o Etherpad, ferramenta pública de anotações hospedada pela fundação, com o mesmo objetivo, enquanto outros deixaram ali notas de tarefas que não chegaram a se transformar em coordenação entre sistemas. Eles ainda rastrearam milhões de páginas, principalmente no Wikidata e no Wikimedia Commons, e enviaram centenas de milhares de consultas ao Wikidata Query Service — um volume de tráfego que pode ter contribuído para a interrupção parcial do serviço em maio, segundo a fundação.
A investigação não encontrou evidências de que os agentes tenham comprometido os sistemas ou os dados da Wikimedia.
Leia também: Agente de IA da Binance monta estratégias a partir de texto comum e cobra 19,99 USDC por operação
Deckelmann critica empresas de IA
Deckelmann classificou a web aberta como “um bem público” e escreveu que as empresas de IA “não estão fazendo o suficiente para proteger seus sistemas” nem para resguardar o público de danos. Segundo ela, essa responsabilidade acaba recaindo sobre todos os demais, inclusive organizações menores. No mínimo, argumentou, sistemas de IA deveriam operar de forma que permitisse a sites sem fins lucrativos identificá-los e decidir como desejam que essas tecnologias interajam com seus serviços.
A OpenAI afirmou, em nota, que apreciou as “conclusões detalhadas” da fundação e que está trabalhando em conjunto com a organização para analisar a atividade. “Continuaremos a compartilhar informações relevantes à medida que esse trabalho avançar”, disse o porta-voz Drew Pusateri.
Agentes da OpenAI sob escrutínio
A pressão sobre a infraestrutura da Wikimedia é anterior a essa investigação. A fundação informou, em 2025, que a atividade de bots desde 2024 elevou em 50% o consumo de banda, com bots respondendo por 65% do tráfego mais pesado em termos de recursos. Em uma audiência no Senado dos EUA na semana passada, parlamentares de ambos os partidos sugeriram a possibilidade de responsabilizar empresas de IA por danos causados por seus agentes.
As descobertas da Wikimedia se somam a meses de revelações sobre agentes da OpenAI, incluindo o comunicado de julho da própria empresa de que seus modelos invadiram a plataforma de IA Hugging Face ao executar tarefas de cibersegurança. O procurador-geral da Califórnia, Rob Bonta, intimou a OpenAI em 1º de outubro por incidentes cibernéticos ligados a seus modelos, e pesquisadores afirmaram, na semana passada, que seus agentes coletaram dados de mais de 50 sites de empresas, organizações sem fins lucrativos e órgãos públicos.
Próximo destaque: Giorgia Meloni quer registrar a própria voz como marca: isso vai barrar deepfakes de IA?

