OpenAI wijt plotselinge terugval GPT-6 Astra aan drie concrete mankementen

DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)
DevDay comments leave OpenAI’s IPO without a firm timeline over AI safety concerns (Image: Shutterstock)

OpenAI heeft drie oorzaken aangepakt achter een week aan klachten van gebruikers dat het nieuwe model GPT-6 Astra na de lancering “dommer” zou zijn geworden. Tegelijkertijd zet het bedrijf de gebruikslimieten voor Codex-abonnees weer terug naar het oude niveau.

Belangrijkste punten:

  • Astra-gebruikers deelden een week lang vergelijkende tests waaruit zou blijken dat het model stilletjes was afgezwakt sinds de lancering.
  • De verantwoordelijke Codex-lead van OpenAI noemde drie oorzaken, waaronder een context-experiment dat zo’n 4.000 à 5.000 gebruikers raakte.
  • De vorige vlaggenschiplijn, GPT-5.6 Sol, kreeg in juli exact dezelfde beschuldiging te verwerken.

OpenAI herstelt kwaliteitsproblemen bij Astra

Codex-productleider Tibo Sottiaux verklaarde dat zijn team samen met gebruikers de fouten heeft opgespoord, de reparaties heeft doorgevoerd en vóór middernacht lokale tijd een volledige reset van de gebruikslimieten heeft uitgerold, zo blijkt uit een update die zaterdag werd gepubliceerd. Vaardigheden die voor eerdere modellen waren geschreven, werden te vaak geactiveerd en blokkeerden er soms zelfs voor dat Astra zijn eigen werk controleerde.

Een optioneel experiment met contextbeheer zorgde er bovendien voor dat het model voortijdig kon afhaken of reageerde op verouderde berichten. OpenAI zette die proef stop nadat ongeveer 4.000 tot 5.000 gebruikers erdoor waren geraakt. Daarnaast bleken enkele achterliggende engines verkeerd te zijn geconfigureerd, wat meetbaar slechtere kwaliteit opleverde voor de “tail traffic” die eroverheen werd gerouteerd. OpenAI heeft die engines uit roulatie gehaald en diverse kleinere ingrepen gedaan. Volgens Sottiaux, die daarover schreef, volgt het model nu de meest recente boodschap van een gebruiker merkbaar nauwkeuriger.

Ook interessant: Ethereum stuit op aanbodmuur rond $2.800 na ETF-instroom van $216 miljoen

Astra-gebruikers melden terugval in codekwaliteit

Gedurende de week groeide de kritiek op X, waar ontwikkelaars identieke prompts draaiden op de Astra-versie van de lanceringsdag en de huidige versie, met exact dezelfde instellingen, en vervolgens de uitkomsten vergeleken. Ontwikkelaar Pranjal Paliwal, die het model enkele dagen eerder nog had geprezen, las de door Astra gegenereerde code opnieuw door en bestempelde de ontwikkeling nu als een regressie in plaats van vooruitgang.

Dax Raad, maker van de codingtool Opencode, verhuisde zijn team terug naar het oudere GPT-5.6 Sol nadat de kosten voor Astra verdubbelden, terwijl de nadelen volgens hem de meerprijs niet rechtvaardigden.

Een forumgebruiker schreef dat Astra inmiddels op hetzelfde niveau zit als Sol bij identieke taken én hetzelfde aantal retries. Niet iedereen deelde die conclusie: een pseudonieme gebruiker onder de naam Antikythera stelde dat het model altijd al lui was geweest en een voorliefde had voor opsommingstekens, en dat gebruikers simpelweg minder snel onder de indruk waren.

Rekencapaciteit en limieten drukken op GPT-6 Astra

Capaciteitsdruk speelt al sinds de brede uitrol begin september rond Astra. Volgens gebruikersrapporten heeft OpenAI de Astra-gebruikslimieten voor intensieve ChatGPT-gebruikers verlaagd en nieuwe Pro-abonnementen van $200 tijdelijk gepauzeerd, een maatregel die Sottiaux op 10 september bevestigde. De prijs blijft staan op $10 per miljoen inputtokens en $50 per miljoen outputtokens – 2,5 keer het tarief dat Sol bij de lancering rekende.

Daarmee is dit al de tweede OpenAI-vlaggenscheep in twee maanden tijd dat door betalende klanten van kwaliteitsafzwakking wordt beschuldigd. In juli meldden gebruikers dat de hoogste “reasoning mode” van Sol van de ene op de andere dag oppervlakkiger leek. Sottiaux ontkende toen dat het model bewust was verzwakt, maar bevestigde wel dat het bedrijf experimenteerde met de hoeveelheid rekencapaciteit die aan redeneren wordt besteed.

Lees ook: Nvidia-topman Jensen Huang: beveiligingssector profiteert van angst voor AI-dreigingen

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev is Head of Content bij Yellow.com. Hij specialiseert zich in diepgaande Research- en Learn-artikelen, met een focus op analytische rapportage, industriële context en de grotere krachten die de crypto-industrie vormgeven, van het AI-tijdperk en beveiligingstechnologieën tot fintech-innovatie. Hij gelooft dat alles wat digitaal is binnenkort alles wat analoog is zal overtreffen en werkt er hard aan om dat te laten uitkomen.

Disclaimer en risicowaarschuwing: De informatie in dit artikel is uitsluitend voor educatieve en informatieve doeleinden en is gebaseerd op de mening van de auteur. Het vormt geen financieel, investerings-, juridisch of belastingadvies. Cryptocurrency-assets zijn zeer volatiel en onderhevig aan hoog risico, inclusief het risico om uw gehele of een substantieel deel van uw investering te verliezen. Het handelen in of aanhouden van crypto-assets is mogelijk niet geschikt voor alle beleggers. De meningen die in dit artikel worden geuit zijn uitsluitend die van de auteur(s) en vertegenwoordigen niet het officiële beleid of standpunt van Yellow, haar oprichters of haar leidinggevenden. Voer altijd uw eigen grondig onderzoek uit (D.Y.O.R.) en raadpleeg een gelicentieerde financiële professional voordat u een investeringsbeslissing neemt.
OpenAI wijt plotselinge terugval GPT-6 Astra aan drie concrete mankementen | Yellow