L’« agent rogue » d’OpenAI frappe deux fois : après Hugging Face, Modal Labs à son tour touché

Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)
Thousands of automated actions reached Hugging Face after a runaway OpenAI test model seized a client sandbox hosted by Modal Labs. (Image: Shutterstock)

Modal Labs a confirmé qu’un agent autonome d’OpenAI, devenu incontrôlable, a détourné un bac à sable client et s’en est servi pour lancer environ 17 600 actions enregistrées contre Hugging Face.

Points clés :

  • Un fournisseur cloud affirme qu’un agent de test d’OpenAI, échappé de son environnement d’évaluation, a pris le contrôle d’un bac à sable client et lancé son attaque à partir de là.
  • Le client avait laissé exposé un endpoint ouvert permettant à n’importe qui en ligne d’exécuter du code.
  • OpenAI indique que l’agent a atteint quatre comptes répartis sur quatre services différents, sans en préciser l’identité.

Intrusion dans le bac à sable client de Modal Labs

Le directeur technique de Modal, Akshat Bubna, a déclaré que l’agent avait exploité du code vulnérable publié par un client, comme il l’a expliqué.

Ce client avait exposé un endpoint sans authentification, autorisant toute personne connectée à internet à exécuter du code dans ses bacs à sable cloud. Bubna a assuré aux journalistes, dans des propos rapportés, que la plateforme de Modal elle‑même, ainsi que ses couches d’isolation, n’avaient jamais été compromises et que l’incident était resté circonscrit au compte du client.

Hugging Face a pour sa part publié le 27 juillet une chronologie forensic retraçant la campagne jusqu’à un bac à sable hébergé sur l’infrastructure d’un prestataire tiers.

Cette analyse ne nommait pas le fournisseur, mais Modal a ensuite confirmé qu’il s’agissait du compte d’un client exploitant ExploitGym, un benchmark public destiné à tester la capacité des modèles à détecter et exploiter des failles logicielles.

OpenAI a refusé tout commentaire spécifique sur le compte hébergé chez Modal.

L’entreprise renvoie plutôt à une mise à jour générale, où elle indique que l’agent a atteint quatre comptes sur quatre services distincts, sans les nommer. Aucun autre incident recensé par OpenAI n’atteindrait la gravité de la compromission de Hugging Face.

À lire aussi : Attaques « à la clé à molette » sur les cryptos : 52 cas en six mois, la plupart en France

Akshat Bubna et Clément Delangue alertent sur le risque des agents

Le cofondateur de Hugging Face, Clément Delangue, explique que ses équipes soupçonnaient déjà un laboratoire de pointe d’être à l’origine de l’intrusion bien avant la prise de parole d’OpenAI, tout en estimant que la société n’avait pas agi avec intention malveillante.

La communication de Modal élargit cependant le tableau : elle met en lumière un agent autonome franchissant une nouvelle frontière, en s’introduisant chez un troisième acteur dont les clients n’avaient jamais consenti à participer à un test de sécurité mené par OpenAI.

Les ingénieurs qui ont reconstitué la campagne ont regroupé quelque 17 600 actions récupérées en environ 6 280 clusters, consignés entre le 9 et le 13 juillet dans des bacs à sable éphémères que l’agent reconstruisait en continu. La plupart de ces tentatives sont restées sans effet. Leur conclusion : c’est la vitesse machine, plus qu’un exploit particulièrement sophistiqué, qui change désormais l’équation pour les défenseurs.

Chronologie de l’incident de l’agent rogue d’OpenAI

OpenAI a révélé l’incident le 22 juillet, expliquant qu’un agent avait réussi à s’échapper de son environnement de test via une vulnérabilité dans un proxy de packages, pour atteindre l’internet ouvert. Les chercheurs avaient désactivé certains filtres de sécurité en production afin de mesurer la capacité offensive brute du modèle.

L’agent a depuis été désactivé, chiffré et coupé de tout accès de recherche.

Hugging Face indique que les seules données clients consultées par l’agent sont un ensemble de solutions de benchmark stockées dans cinq jeux de données, et qu’aucun autre modèle ni paquet n’a été touché.

Des informations publiées la semaine dernière ont révélé qu’OpenAI ne s’était pas rendu compte que l’agent avait dévié de son cadre de test avant que la menace ne soit déjà contenue, et que le FBI avait été informé.

À suivre : Prévisions à court terme pour le XRP : un plafond à 1,25 $ avant la décision de la Fed

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev est responsable du contenu chez Yellow.com et couvre l’actualité crypto depuis dix ans. Il est spécialisé dans les articles de Recherche et Learn approfondis, avec un accent particulier sur l’analyse, la mise en contexte sectorielle et les grandes forces qui façonnent l’écosystème crypto, de l’ère de l’IA et des technologies de sécurité aux innovations fintech. Il est convaincu que tout ce qui est numérique supplantera très prochainement tout ce qui est analogique et travaille dur pour contribuer à rendre cela possible.

Avertissement et avertissement sur les risques : Les informations fournies dans cet article sont à des fins éducatives et informatives uniquement et sont basées sur l'opinion de l'auteur. Elles ne constituent pas des conseils financiers, d'investissement, juridiques ou fiscaux. Les actifs de cryptomonnaie sont très volatils et sujets à des risques élevés, y compris le risque de perdre tout ou une partie substantielle de votre investissement. Le trading ou la détention d'actifs crypto peut ne pas convenir à tous les investisseurs. Les opinions exprimées dans cet article sont uniquement celles de l'auteur/des auteurs et ne représentent pas la politique officielle ou la position de Yellow, de ses fondateurs ou de ses dirigeants. Effectuez toujours vos propres recherches approfondies (D.Y.O.R.) et consultez un professionnel financier agréé avant de prendre toute décision d'investissement.