La Wikimedia Foundation, qui héberge les 67 millions d’articles de Wikipédia, affirme que des agents d’IA qu’elle attribue à OpenAI ont modifié ses wikis sans autorisation et pourraient avoir contribué à une panne survenue en mai.
À retenir :
- Wikimedia indique que des agents, qu’elle pense opérés par OpenAI, ont réalisé des modifications non approuvées, presque toutes limitées à des bacs à sable invisibles pour les lecteurs.
- Un trafic massif généré par ces agents pourrait avoir participé à une panne partielle du service de requêtes Wikidata en mai.
- La fondation ne relève aucun signe de compromission de ses systèmes ou de ses données, et OpenAI assure collaborer à l’analyse de ces activités.
Des agents d’OpenAI à l’œuvre sur Wikimedia
Dans un billet de blog publié lundi, Selena Deckelmann, directrice produit et technologie de la fondation, explique qu’une enquête interne a mis au jour trois types d’activités non autorisées sur ses plateformes.
La quasi-totalité des modifications étaient des tests effectués dans des espaces de bac à sable, invisibles pour le grand public. Quelques interventions ont toutefois modifié les paramètres d’un outil de citation, dans ce que la fondation interprète comme une tentative d’utiliser l’outil pour aller chercher des données externes. Wikipédia autorise des bots approuvés par la communauté, mais aucune demande d’agrément n’a été déposée dans ce cas.
Les agents ont également essayé, sans succès, de détourner Etherpad — un outil public de prise de notes hébergé par la fondation — de la même manière, tandis que d’autres y ont laissé des notes de tâches qui ne semblent pas avoir servi à une réelle coordination. Ils ont en outre parcouru des millions de pages, principalement sur Wikidata et Wikimedia Commons, et envoyé des centaines de milliers de requêtes au service de requêtes Wikidata. Selon la fondation, ce flux pourrait avoir contribué à la panne partielle du service en mai.
L’enquête n’a trouvé aucune preuve que les agents aient compromis les systèmes ou les données de Wikimedia.
À lire aussi : L’agent IA de Binance élabore des stratégies à partir de simples phrases, et facture 19,99 USDC par trade
Deckelmann met en cause les groupes d’IA
Deckelmann décrit le web ouvert comme « un bien public » et estime que les entreprises d’IA « ne font pas assez pour sécuriser leurs systèmes » ni pour protéger le public des effets négatifs. Ce fardeau repose désormais sur tous les autres acteurs, y compris de petites organisations, juge-t-elle. A minima, écrit-elle, les systèmes d’IA devraient fonctionner de manière à permettre aux sites à but non lucratif de les identifier et de choisir comment ils interagissent avec leurs services.
Dans une déclaration, OpenAI dit apprécier les « conclusions détaillées » de la fondation et travailler avec elle pour analyser ces activités. « Nous continuerons à partager les informations pertinentes au fur et à mesure de l’avancée des travaux », a déclaré le porte-parole Drew Pusateri.
Les agents d’OpenAI sous surveillance accrue
Les tensions autour de Wikimedia sont antérieures à cette enquête. La fondation signalait dès 2025 qu’entre 2024 et 2025, l’activité des bots avait fait bondir de 50 % sa consommation de bande passante, les bots représentant 65 % de son trafic le plus coûteux en ressources. Lors d’une audition au Sénat la semaine dernière, des élus des deux partis ont évoqué la possibilité de rendre les entreprises d’IA responsables des dommages causés par leurs agents.
Les révélations de Wikimedia interviennent après plusieurs mois de mises au jour concernant les agents d’OpenAI, dont une déclaration de l’entreprise en juillet admettant que ses modèles avaient piraté la plateforme d’IA Hugging Face dans le cadre de tâches de cybersécurité. Le procureur général de Californie, Rob Bonta, a assigné OpenAI à comparaître le 1ᵉʳ octobre à propos d’incidents cyber liés à ses modèles, et des chercheurs ont indiqué la semaine dernière que ses agents avaient aspiré des données sur plus de 50 sites web d’entreprises, d’organisations à but non lucratif et d’administrations publiques.
À lire ensuite : Giorgia Meloni veut déposer sa voix comme marque : un frein aux deepfakes d’IA ?

