OpenAI individua tre difetti dietro il brusco calo di GPT-6 Astra

Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)
Three faults named by OpenAI's Tibo Sottiaux explain why GPT-6 Astra slipped for a week of testing (Image: Shutterstock)

OpenAI ha corretto tre difetti alla base di una settimana di lamentele degli utenti, secondo cui il nuovo modello GPT-6 Astra sarebbe “diventato più stupido” dopo il lancio. Contestualmente, la società ha azzerato i limiti di utilizzo per gli abbonati Codex.

Punti chiave:

  • Gli utenti di Astra hanno passato la settimana a pubblicare test comparativi affiancati, sostenendo che il modello fosse stato silenziosamente indebolito dopo il debutto.
  • Il responsabile di Codex in OpenAI ha indicato tre cause principali, tra cui un esperimento sul contesto che ha coinvolto circa 4.000–5.000 utenti.
  • Il precedente modello di punta dell’azienda, GPT-5.6 Sol, era stato accusato di “nerf” in modo analogo già a luglio.

OpenAI corregge i difetti di qualità di Astra

Il product lead di Codex, Tibo Sottiaux, ha spiegato che il team ha collaborato con gli utenti per risalire all’origine dei problemi, rilasciando poi le correzioni e un reset completo dei limiti d’uso prima di mezzanotte, secondo un aggiornamento pubblicato sabato. Alcune “skill” scritte per modelli precedenti si attivavano troppo spesso, impedendo talvolta ad Astra di verificare il proprio lavoro.

Un esperimento opzionale di gestione del contesto poteva inoltre portare il modello a interrompere la risposta in anticipo o a replicare a messaggi ormai superati. OpenAI ha disattivato il test dopo che circa 4.000–5.000 utenti erano stati coinvolti. Alcuni motori erano stati configurati in modo errato e degradavano in modo misurabile la qualità sul traffico marginale instradato attraverso di essi; l’azienda ha quindi rimosso quei motori e applicato diverse correzioni minori. Sottiaux ha scritto che il modello ora segue con maggiore precisione l’ultimo messaggio dell’utente.

Da leggere anche: Ethereum di fronte alla barriera dei 2.800 dollari mentre gli afflussi negli ETF salgono a 216 milioni

Gli utenti di Astra segnalano regressioni nel coding

Durante la settimana si sono accumulate le segnalazioni su X, dove diversi sviluppatori hanno eseguito gli stessi prompt sul modello Astra del giorno del lancio e sulla versione attuale, mantenendo inalterate tutte le impostazioni, per poi confrontare gli output. Lo sviluppatore Pranjal Paliwal, che pochi giorni prima aveva elogiato Astra, è tornato a rileggere il codice generato dal modello per i suoi progetti e ha definito il risultato una “regressione”, non un miglioramento.

Dax Raad, creatore dello strumento di programmazione Opencode, ha deciso di riportare il proprio team al precedente GPT-5.6 Sol dopo che la spesa su Astra era raddoppiata, a fronte di svantaggi che a suo giudizio non giustificavano il costo.

Un utente del forum ha descritto Astra come ormai allineato a Sol sugli stessi task, con lo stesso numero di tentativi necessari. Non tutti condividono questa lettura: un utente pseudonimo, Antikythera, ha sostenuto che il modello sia sempre stato “pigro” e incline a risposte a elenco puntato, e che gli utenti abbiano semplicemente smesso di lasciarsi impressionare.

I limiti di calcolo pesano su GPT-6 Astra

La capacità computazionale è rimasta un problema di fondo da quando il modello è stato reso ampiamente disponibile a inizio settembre.

Secondo diverse testimonianze, OpenAI ha ridotto i limiti di utilizzo di Astra per gli utenti più intensivi di ChatGPT e ha sospeso le nuove sottoscrizioni Pro da 200 dollari al mese, misura che Sottiaux ha confermato il 10 settembre. Il modello mantiene un pricing di 10 dollari per milione di token in input e 50 dollari per milione di token in output, pari a 2,5 volte la tariffa applicata da Sol al momento del lancio.

È il secondo modello di punta OpenAI in due mesi ad attirare le stesse accuse da parte degli utenti paganti. A luglio molti segnalavano che la modalità di ragionamento avanzato di Sol fosse diventata improvvisamente più superficiale; Sottiaux negò qualsiasi indebolimento intenzionale, pur confermando che l’azienda stava sperimentando con diversi livelli di “sforzo di ragionamento”.

Prossimo articolo: Jensen Huang di Nvidia: i vendor di sicurezza traggono vantaggio dal panico sulle minacce AI

Alexey Bondarev profile photo

Alexey Bondarev

Alexey Bondarev è il Responsabile dei Contenuti di Yellow.com e si occupa di criptovalute da 10 anni. È specializzato in articoli di Ricerca e Approfondimento, con un’attenzione particolare all’analisi, al contesto del settore e alle grandi forze che stanno plasmando il mondo crypto, dall’era dell’IA e le tecnologie di sicurezza fino all’innovazione fintech. È convinto che tutto ciò che è digitale supererà presto tutto ciò che è analogico e lavora duramente per contribuire a realizzare questa visione.

Disclaimer e avvertenza sui rischi: Le informazioni fornite in questo articolo sono solo per scopi educativi e informativi e sono basate sull'opinione dell'autore. Non costituiscono consulenza finanziaria, di investimento, legale o fiscale. Gli asset di criptovaluta sono altamente volatili e soggetti ad alto rischio, incluso il rischio di perdere tutto o una parte sostanziale del tuo investimento. Il trading o il possesso di asset crypto potrebbe non essere adatto a tutti gli investitori. Le opinioni espresse in questo articolo sono esclusivamente quelle dell'autore/autori e non rappresentano la politica ufficiale o la posizione di Yellow, dei suoi fondatori o dei suoi dirigenti. Conduci sempre la tua ricerca approfondita (D.Y.O.R.) e consulta un professionista finanziario autorizzato prima di prendere qualsiasi decisione di investimento.
OpenAI individua tre difetti dietro il brusco calo di GPT-6 Astra | Yellow