OpenAI affirme qu’une offensive liée à Moonshot et 16 000 requêtes a tenté de percer la logique cachée de ses modèles

Chinese AI developer Moonshot faces OpenAI claims that linked users tried to extract its hidden model reasoning (Image: Shutterstock)
Chinese AI developer Moonshot faces OpenAI claims that linked users tried to extract its hidden model reasoning (Image: Shutterstock)

OpenAI affirme que des acteurs liés au rival chinois Moonshot AI se trouvent au cœur d’une vaste opération visant à extraire la logique interne de ses modèles, une campagne qui a culminé à 16 000 requêtes en juillet.

À retenir :

  • OpenAI relie le noyau de l’activité de juillet à des personnes associées à Moonshot, le développeur de Kimi.
  • Les opérateurs ont copié la « logique chiffrée » entre différentes conversations, sans parvenir à casser le chiffrement d’OpenAI.
  • Moonshot n’a pas réagi publiquement, tandis que Pékin a déjà rejeté de précédentes accusations de « distillation » formulées par les États-Unis.

OpenAI met en cause Moonshot

OpenAI a révélé ces conclusions mercredi dans un billet de blog. L’activité a débuté à bas bruit le 1er juillet, explique l’entreprise. Elle a ensuite explosé les 24 et 25 juillet, lorsque plus de 4 000 utilisateurs ont envoyé 16 000 requêtes suivant le même schéma d’extraction.

OpenAI a par la suite identifié des activités connexes impliquant plus de 15 000 comptes et affirme avoir totalement démantelé la campagne au 28 juillet.

La société n’a pas pu relier chaque compte à un acteur unique, mais attribue le noyau dur de l’opération à des personnes associées à Moonshot, le développeur chinois des modèles Kimi.

OpenAI masque la chaîne de raisonnement de ses modèles avant l’émission de la réponse. Selon l’entreprise, les opérateurs ont copié ce texte chiffré d’une conversation et l’ont collé dans une autre, en demandant à un second modèle de le retranscrire. Ils n’ont toutefois jamais réussi à casser le chiffrement ni à accéder à l’historique des conversations utilisateurs. OpenAI indique avoir depuis supprimé les comptes concernés, renforcé les contrôles à l’inscription et partagé ses conclusions avec d’autres laboratoires d’IA et avec les autorités.

À lire aussi : Bitget relève son fonds de protection au‑dessus de 300 M$ à la reprise des retraits

Les craintes d’OpenAI sur la « distillation »

Caroline Zier, responsable des initiatives de politique de sécurité nationale chez OpenAI, a déclaré que l’entreprise s’oppose aux violations de ses conditions d’utilisation, « pas aux modèles ouverts ni à la distillation légitime ».

La distillation – transférer des connaissances d’un modèle vers un autre – est devenue une pratique courante dans le secteur. Dans son billet, OpenAI met toutefois en garde : une logique extraite pourrait servir à entraîner un modèle concurrent sans les garde‑fous initiaux, permettant de diffuser des capacités avancées « sans nécessiter le même investissement en matière de sûreté ». David Sacks, ancien « tsar de l’IA » du président Donald Trump, voit dans ces alertes une tentative de pousser Washington à interdire les modèles ouverts qui menacent les modèles économiques d’OpenAI et d’Anthropic.

Moonshot Kimi dans le viseur

Moonshot n’a pas, pour l’heure, répondu publiquement à ces allégations. Le gouvernement chinois a déjà rejeté de précédentes accusations de distillation formulées par des groupes américains et par l’administration Trump, en avertissant qu’il riposterait à toute sanction américaine.

Moonshot a lancé son modèle Kimi K3 le 16 juillet. En quelques semaines, le conseiller scientifique de la Maison‑Blanche Michael Kratsios affirmait que l’entreprise avait accédé à des serveurs Nvidia Blackwell interdits de vente aux acteurs chinois, et qu’elle avait siphonné des données de modèles américains. Puis, le 10 septembre, Anthropic a rapporté que Moonshot avait routé en secret quelque 300 000 requêtes d’utilisateurs vers ses modèles Claude, en passant par 5 380 comptes frauduleux.

À suivre : Dogecoin va enfin se doter d’une couche applicative après 12 ans d’attente

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev est responsable du contenu chez Yellow.com. Il se spécialise dans des articles de recherche et d’apprentissage approfondis, avec un accent sur les analyses, le contexte sectoriel et les grandes forces qui façonnent la crypto, de l’ère de l’IA et des technologies de sécurité à l’innovation fintech. Il est convaincu que tout ce qui est numérique dépassera très bientôt tout ce qui est analogique et travaille dur pour que cela devienne réalité.

Avertissement et avertissement sur les risques : Les informations fournies dans cet article sont à des fins éducatives et informatives uniquement et sont basées sur l'opinion de l'auteur. Elles ne constituent pas des conseils financiers, d'investissement, juridiques ou fiscaux. Les actifs de cryptomonnaie sont très volatils et sujets à des risques élevés, y compris le risque de perdre tout ou une partie substantielle de votre investissement. Le trading ou la détention d'actifs crypto peut ne pas convenir à tous les investisseurs. Les opinions exprimées dans cet article sont uniquement celles de l'auteur/des auteurs et ne représentent pas la politique officielle ou la position de Yellow, de ses fondateurs ou de ses dirigeants. Effectuez toujours vos propres recherches approfondies (D.Y.O.R.) et consultez un professionnel financier agréé avant de prendre toute décision d'investissement.
OpenAI affirme qu’une offensive liée à Moonshot et 16 000 requêtes a tenté de percer la logique cachée de ses modèles | Yellow