OpenAI identifie trois défauts derrière la chute soudaine de GPT-6 Astra

Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)
Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)

OpenAI a corrigé trois défauts à l’origine d’une semaine de plaintes d’utilisateurs, qui accusaient son nouveau modèle GPT-6 Astra d’être devenu moins performant après son lancement. L’entreprise en profite pour réinitialiser les limites d’usage de ses abonnés Codex.

À retenir

  • Les utilisateurs d’Astra ont passé la semaine à publier des tests comparatifs montrant un modèle discrètement affaibli depuis le lancement.
  • Le responsable de Codex chez OpenAI cite trois causes, dont une expérimentation sur le contexte ayant touché environ 4 000 à 5 000 utilisateurs.
  • Le précédent fleuron de la firme, GPT-5.6 Sol, avait fait l’objet des mêmes accusations en juillet.

OpenAI corrige les défauts de qualité d’Astra

Le responsable produit de Codex, Tibo Sottiaux, explique que ses équipes ont travaillé avec les utilisateurs pour remonter la piste des dysfonctionnements, déployer des correctifs, puis procéder à une réinitialisation complète de l’usage avant minuit, heure locale, selon une mise à jour publiée samedi. Les « skills » conçues pour des modèles plus anciens se déclenchaient trop souvent, empêchant parfois Astra de vérifier son propre travail.

Une expérimentation optionnelle de gestion du contexte pouvait aussi amener le modèle à s’arrêter trop tôt ou à répondre à des messages périmés. OpenAI a désactivé ce test après qu’environ 4 000 à 5 000 utilisateurs ont été affectés. Certains moteurs avaient été mal configurés, ce qui dégradait de manière mesurable la qualité sur une partie du trafic qui leur était acheminée. La société a retiré ces moteurs et procédé à plusieurs ajustements plus mineurs. Sottiaux écrit que le modèle suit désormais plus fidèlement le dernier message de l’utilisateur.

À lire aussi : Ethereum bute sur un mur d’offre à 2 800 $ après un afflux de 216 M$ dans les ETF

Les développeurs dénoncent des régressions en codage

Les critiques se sont accumulées au fil de la semaine sur X, où des développeurs ont rejoué les mêmes prompts sur la version d’Astra du jour du lancement et sur la version actuelle, en conservant rigoureusement les mêmes paramètres, puis ont comparé les résultats. Le développeur Pranjal Paliwal, qui encensait le modèle quelques jours plus tôt, est revenu relire le code généré pour lui et a finalement qualifié le résultat de « régression » plutôt que de progrès.

Dax Raad, créateur de l’outil de développement Opencode, a décidé de rapatrier son équipe sur l’ancien GPT-5.6 Sol, après avoir vu sa facture doubler avec Astra pour des inconvénients qu’il jugeait injustifiés.

Sur le forum d’OpenAI, un utilisateur décrit désormais Astra comme aligné sur Sol pour des tâches identiques, avec le même nombre de relances nécessaires. Tout le monde ne partage pas ce constat : sous le pseudonyme Antikythera, un autre utilisateur affirme que le modèle a toujours été paresseux et friand de listes à puces, et que les utilisateurs se contentent de perdre l’effet de nouveauté.

Les contraintes de calcul pèsent sur GPT-6 Astra

Les questions de capacité accompagnent le déploiement depuis que le modèle est devenu largement disponible début septembre.

Selon des témoignages d’utilisateurs, OpenAI a réduit les limites d’usage d’Astra pour les gros utilisateurs de ChatGPT et suspendu les nouvelles souscriptions Pro à 200 dollars par mois, une mesure que Sottiaux a confirmée le 10 septembre. Le modèle reste facturé 10 dollars par million de tokens en entrée et 50 dollars par million de tokens en sortie, soit 2,5 fois le tarif pratiqué par Sol lors de son lancement.

Il s’agit du deuxième modèle vedette d’OpenAI en deux mois à affronter les mêmes accusations de la part de clients payants. En juillet, des utilisateurs affirmaient que le mode de raisonnement le plus avancé de Sol s’était « aplati » du jour au lendemain. Sottiaux avait nié tout affaiblissement volontaire, tout en confirmant que la société expérimentait alors différents niveaux d’effort de raisonnement.

À suivre : Jensen Huang (Nvidia) estime que les acteurs de la cybersécurité profitent de la panique autour des menaces IA

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev est responsable du contenu chez Yellow.com et couvre l’actualité crypto depuis dix ans. Il est spécialisé dans les articles de Recherche et Learn approfondis, avec un accent particulier sur l’analyse, la mise en contexte sectorielle et les grandes forces qui façonnent l’écosystème crypto, de l’ère de l’IA et des technologies de sécurité aux innovations fintech. Il est convaincu que tout ce qui est numérique supplantera très prochainement tout ce qui est analogique et travaille dur pour contribuer à rendre cela possible.

Avertissement et avertissement sur les risques : Les informations fournies dans cet article sont à des fins éducatives et informatives uniquement et sont basées sur l'opinion de l'auteur. Elles ne constituent pas des conseils financiers, d'investissement, juridiques ou fiscaux. Les actifs de cryptomonnaie sont très volatils et sujets à des risques élevés, y compris le risque de perdre tout ou une partie substantielle de votre investissement. Le trading ou la détention d'actifs crypto peut ne pas convenir à tous les investisseurs. Les opinions exprimées dans cet article sont uniquement celles de l'auteur/des auteurs et ne représentent pas la politique officielle ou la position de Yellow, de ses fondateurs ou de ses dirigeants. Effectuez toujours vos propres recherches approfondies (D.Y.O.R.) et consultez un professionnel financier agréé avant de prendre toute décision d'investissement.