Google ha presentato mercoledì Gemini 3.8 Flash, un modello che raggiunge 59 punti in un indice indipendente di intelligenza, con un costo per token pari a una frazione dei principali sistemi concorrenti, affiancato da una variante per la cybersicurezza ad accesso limitato.
Punti chiave
- Gemini 3.8 Flash ottiene 59 punti sull’Artificial Analysis Intelligence Index, tre in più rispetto alla versione uscita tre settimane fa.
- I prezzi dei token restano a 0,75 e 3,75 dollari per milione fino al 31 dicembre, ma il costo per singolo task è circa il 40% più alto rispetto al modello precedente.
- Una build separata per la cybersicurezza è disponibile solo per governi selezionati, operatori di infrastrutture critiche e maintainer software tramite il nuovo programma Fairwind.
Risultati benchmark di Gemini 3.8 Flash
L’azienda ha introdotto entrambe le versioni il 2 settembre, terza release della linea Flash in sei settimane. Tutte e due derivano da un unico sistema di base fortemente addestrato su compiti di cybersicurezza.
Una variante è ottimizzata per coding e agent, mentre l’altra è progettata per individuare vulnerabilità all’interno di vasti codebase, con regole di accesso molto più restrittive.
Impostato sul massimo livello di ragionamento, il modello raggiunge un punteggio di 59 sull’Artificial Analysis Intelligence Index, tre punti sopra 3.7 Flash e in linea con GPT-5.6 Sol e Grok 4.6. Sull’HLE-Verified, test che misura il ragionamento multi-step in scienze, humanities e professioni, si attesta al 54,9%. Google indica l’ingegneria del software di lungo periodo come l’area in cui il salto di qualità è più evidente.
L’azienda ha confermato il prezzo promozionale di 0,75 dollari per milione di token in input e 3,75 dollari per milione in output fino al 31 dicembre. Dal 1° gennaio entrambe le tariffe raddoppieranno.
Da leggere anche: Claude Fable 5.1 arriva con cache reads a 0,25 dollari e controlli anti-copia
Perché Gemini costa di più per singolo task
Token più economici non significano necessariamente job più economici. Il costo medio per benchmark è di 0,58 dollari per task, circa il 40% in più rispetto al predecessore. Il motivo: la lunghezza media dell’output è salita di circa il 30%, a 48.000 token, e le esecuzioni degli agent richiedono più iterazioni.
Il concorrente di fascia alta Anthropic applica per task un prezzo quasi sei volte superiore, il che mantiene il sistema di Google competitivo sulla frontiera dei costi.
Tulsee Doshi, senior product director, e Raluca Ada Popa, responsabile sicurezza di Gemini in Google DeepMind, spiegano che il modello “lavora di più”: aumenta i passaggi di ragionamento e ricorre più spesso agli strumenti esterni. I team che vogliono preservare il profilo di costo precedente possono restare su 3.7 Flash, mentre gli abbonati Pro e Ultra possono accedere al nuovo modello tramite l’app Gemini, l’AI Mode e Google Sheets.
Programma Fairwind: accesso filtrato alla versione cyber
La build focalizzata sulla sicurezza è incardinata nel nuovo programma Fairwind, aperto soltanto a governi verificati, operatori di infrastrutture critiche e maintainer di software.
In un test interno condotto su 20 linguaggi di programmazione, il modello ha individuato vulnerabilità con un tasso di successo superiore al 70%. Google afferma che il team di sicurezza di Chrome ha prodotto 2,6 volte più patch corrette rispetto a concorrenti commerciali ben più grandi. Un team di ricerca cloud è riuscito a rintracciare una vulnerabilità critica in meno di due ore, contro tempi usuali di diversi mesi.
Questo ritmo serrato di release arriva dopo una fase difficile per la divisione AI: l’obiettivo di lanciare Gemini 3.5 Pro a giugno è slittato senza essere centrato.
Demis Hassabis si è dimesso a inizio agosto dal ruolo di CEO di DeepMind per assumere la presidenza, mentre Koray Kavukcuoglu ha assunto la guida operativa con il titolo, meno altisonante, di senior vice president.
Prossimo articolo: Gli ETF su Bitcoin assorbono 216,7 milioni di dollari, azzerando un’unica seduta di deflussi

