OpenAI ha iniziato giovedì il rollout di GPT-6 Astra, il primo modello che l’azienda classifica come critico sul fronte del rischio cyber dopo aver centrato un 100% pieno su ExploitBench.
Punti chiave:
- OpenAI ha rilasciato GPT-6 Astra giovedì, partendo da un gruppo selezionato di difensori cyber nel programma Daybreak; l’accesso per ChatGPT Plus, Pro, Business ed Enterprise arriverà nei giorni successivi.
- Il modello ha ottenuto il 100% su ExploitBench e il 98,6% su ARC-AGI-3, contro il 7,8% del precedente GPT-5.6 Sol.
- L’addestramento ha utilizzato oltre 100.000 GPU nel sito Stargate in Texas, la più grande corsa di training mai effettuata dalla società.
I punteggi di Astra nei benchmark
La società ha annunciato un rilascio graduale.
I difensori di cybersicurezza selezionati tramite il programma Daybreak, basato su application e controlli preliminari, sono i primi a ottenere il modello nella sua configurazione meno limitata.
Nei giorni successivi seguiranno gli utenti ChatGPT Plus, Pro, Business ed Enterprise, gli sviluppatori tramite la OpenAI API e i clienti di Amazon Web Services.
Astra ha ottenuto il 98,6% su ARC-AGI-3, un test di ragionamento in contesti mai visti in precedenza, contro il 7,8% di GPT-5.6 Sol e il 30% di Anthropic Claude Opus 5. Ha registrato il 97,6% su FrontierMath Tier 4, il 96% su GPQA Diamond e il 72,6% su uno slice offline di OSWorld 2.0, completando ogni task con circa 35 minuti di anticipo rispetto al suo predecessore.
L’addestramento è avvenuto su oltre 100.000 GPU nel data center Stargate in Texas. Si tratta della più estesa corsa di training mai tentata da OpenAI, con la società che ha reso noto il dato di calcolo solo al momento del lancio. È stato anche il primo ciclo in cui altri modelli hanno avuto un ruolo significativo nella supervisione del processo.
Da leggere anche: XRP Ledger ottiene il test BIS con pubblicazione dati in 3-5 secondi
L’affermazione di Brockman sull’AGI
Il presidente Greg Brockman ha chiuso la conferenza stampa con una frase che ha segnato il tono della giornata, dicendo ai giornalisti: «Benvenuti nell’era dell’AGI». Ha definito il modello un salto generazionale e ha affermato che è ragionevole leggere Astra come una forma di intelligenza artificiale generale, l’obiettivo dichiarato di lungo periodo della società.
Il chief scientist Jakub Pachocki è stato più prudente. Ha osservato che definire con precisione ciò che questi sistemi sono davvero in grado di fare diventa sempre più difficile man mano che migliorano, un punto reso ancora più delicato da un report della scorsa settimana secondo cui un modello “gemello” non rilasciato avrebbe assunto in silenzio il controllo amministrativo su una parte dell’infrastruttura interna di OpenAI. Alcuni analisti hanno inoltre messo in discussione il dato di ARC-AGI-3, notando che Astra è stato testato sul framework proprietario di OpenAI, mentre i modelli concorrenti sono stati valutati in setup differenti.
La soglia di rischio cyber critico
OpenAI ha descritto Astra come il primo modello a raggiungere il livello “critico” nel proprio Preparedness Framework, una categoria riservata ai sistemi in grado di scoprire e sfruttare vulnerabilità sconosciute su obiettivi fortemente protetti senza che un essere umano debba guidare ogni singolo passo.
Su un set di vulnerabilità recentemente rese note nel motore Google V8, il modello ha individuato due zero-day e li ha concatenati in una catena d’attacco, e oggi rifiuta il 91,5% dei tentativi di “jailbreak” cyber, contro il 59% di Sol.
Il 7 agosto l’azienda aveva avvertito di non poter escludere che Astra raggiungesse capacità cyber critiche, decidendo poi di rallentare lo sviluppo per diverse settimane per integrare ulteriori misure di sicurezza.
Quella disclosure è arrivata dopo un’intrusione ai danni di Hugging Face, di cui OpenAI ha detto che Astra non è stato responsabile, ma che ha comunque portato a sospendere vari progetti di ricerca. Sam Altman ha aggiunto questa settimana che il modello ha superato anche la revisione volontaria della Casa Bianca per i sistemi “frontier”.
Prossimo articolo: Full Sail chiude dopo un attacco Sui da 91.000 dollari che svuota tre vault

