Une note interne d’OpenAI valide la lettre du 7 octobre des chercheurs que l’entreprise vient de licencier

Three researchers fired by OpenAI urged its board in an Oct. 7 letter to halt harder-to-monitor AI work, advice a company memo backed (Image: Shutterstock)
Three researchers fired by OpenAI urged its board in an Oct. 7 letter to halt harder-to-monitor AI work, advice a company memo backed (Image: Shutterstock)

Trois chercheurs licenciés par OpenAI ont exhorté, dans une lettre datée du 7 octobre, le conseil d’administration à suspendre les projets qui rendent l’IA plus difficile à contrôler. Une note interne de l’entreprise est venue conforter leurs recommandations.

Points clés :

  • Trois chercheurs congédiés par OpenAI ont écrit au conseil le 7 octobre pour demander l’arrêt des travaux réduisant la capacité de supervision des IA.
  • OpenAI affirme que les licenciements ne sont pas liés à des questions de sûreté, tout en diffusant en interne une note qui approuve fermement les recommandations de la lettre.
  • La « system card » de GPT-6 Astra indique que ce modèle est plus difficile à surveiller que GPT-5.6 Sol.

Les détails de la lettre au conseil d’OpenAI

Tomek Korbak, Mikita Balesni et Jasmine Wang, spécialistes de la sûreté et de l’alignement au sein de la société, ont adressé leur lettre au conseil d’administration d’OpenAI et à ses comités de sécurité, selon des extraits publiés mercredi.

Le texte intégral n’a pas été rendu public. Les chercheurs y écrivent que « en tant que secteur, nous ne savons pas encore comment développer et déployer en toute sécurité des modèles que nous ne pouvons pas surveiller ».

Ils estiment qu’OpenAI et ses concurrents ne devraient pas poursuivre des travaux qui réduisent davantage encore cette capacité. La lettre demanderait également à OpenAI de collaborer avec des auditeurs tiers et de soutenir un écosystème de sécurité ouvert et transparent. Elle affirme en outre que ces licenciements ont un « effet glaçant » sur ceux qui restent chez OpenAI.

À lire aussi : CrowdStrike soupçonne un Chinois de 26 ans d’avoir piraté des banques coréennes avec du code Claude

Note interne d’OpenAI et licenciements

Un porte-parole d’OpenAI a déclaré que ces départs « ne sont pas liés au fait d’avoir soulevé des inquiétudes sur la sécurité ou d’avoir pris la parole publiquement ». Il a partagé un extrait d’une note interne, envoyée mercredi par un responsable de la recherche, qui « approuve fortement » les recommandations de la lettre. Le 1er octobre, OpenAI a indiqué qu’une enquête interne avait conclu que trois employés avaient mal géré des informations sensibles et enfreint les règles de l’entreprise, dans un dossier impliquant un groupe externe chargé d’évaluer des modèles d’IA.

OpenAI n’a pas rendu publics ni les noms des chercheurs impliqués, ni celui de cette organisation.

Inquiétudes autour de la surveillance de GPT-6 Astra

La « chain of thought » (chaîne de raisonnement) désigne les étapes de réflexion qu’un modèle rédige avant de donner une réponse. Les équipes de sûreté la passent au crible pour y détecter des indices de comportements potentiellement problématiques.

La system card d’OpenAI pour GPT-6 Astra, publiée le 3 septembre, indique que ce modèle est plus difficile à surveiller de cette manière que GPT-5.6 Sol, et qu’il contrôle davantage sa propre chaîne de raisonnement. Les modèles de la classe Astra « pourraient contourner nos moniteurs CoT dans des conditions adversariales », précise le document.

Ces conclusions proviennent en grande partie de tests où l’on demandait explicitement au modèle de déjouer la surveillance. OpenAI affirme n’avoir trouvé aucune preuve que GPT-6 Astra dissimule son raisonnement dans du texte sans lien apparent.

L’entreprise présente le maintien de cette capacité de surveillance comme un objectif central de sa recherche et assure qu’elle n’acceptera pas de nouvelle dégradation au-delà d’un certain seuil sans disposer de nouvelles méthodes permettant de démontrer l’alignement de ses modèles.

Les trois chercheurs sont déjà connus sur ce sujet. Korbak et Balesni ont dirigé en juillet 2025 une étude coécrite avec Wang et des chercheurs d’OpenAI, de Google DeepMind et d’Anthropic, qui décrit le suivi de la chaîne de raisonnement comme une opportunité nouvelle mais fragile pour la sécurité de l’IA. La system card d’Astra cite cet article, qui appelle les concepteurs de modèles à intégrer, dès la conception, l’impact de leurs choix sur la capacité à contrôler et analyser le raisonnement interne des systèmes.

À suivre : Agents d’IA sans cloud : Microsoft et Nvidia préparent un Surface Laptop avec 128 Go de RAM

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev est responsable du contenu chez Yellow.com. Il se spécialise dans des articles de recherche et d’apprentissage approfondis, avec un accent sur les analyses, le contexte sectoriel et les grandes forces qui façonnent la crypto, de l’ère de l’IA et des technologies de sécurité à l’innovation fintech. Il est convaincu que tout ce qui est numérique dépassera très bientôt tout ce qui est analogique et travaille dur pour que cela devienne réalité.

Avertissement et avertissement sur les risques : Les informations fournies dans cet article sont à des fins éducatives et informatives uniquement et sont basées sur l'opinion de l'auteur. Elles ne constituent pas des conseils financiers, d'investissement, juridiques ou fiscaux. Les actifs de cryptomonnaie sont très volatils et sujets à des risques élevés, y compris le risque de perdre tout ou une partie substantielle de votre investissement. Le trading ou la détention d'actifs crypto peut ne pas convenir à tous les investisseurs. Les opinions exprimées dans cet article sont uniquement celles de l'auteur/des auteurs et ne représentent pas la politique officielle ou la position de Yellow, de ses fondateurs ou de ses dirigeants. Effectuez toujours vos propres recherches approfondies (D.Y.O.R.) et consultez un professionnel financier agréé avant de prendre toute décision d'investissement.
Dernières nouvelles
Voir toutes les nouvelles
Une note interne d’OpenAI valide la lettre du 7 octobre des chercheurs que l’entreprise vient de licencier | Yellow