Google ha lanciato Gemini 3.7 Flash tre settimane dopo la 3.6, con un punteggio DeepSWE del 65,3% e un prezzo introduttivo pari alla metà della tariffa di debutto del modello precedente.
Punti chiave:
- Gemini 3.7 Flash porta il punteggio DeepSWE v1.1 al 65,3% e raggiunge 1588 Elo nello sviluppo web.
- Prezzi introduttivi a 0,75 $ per 1M token in input e 3,75 $ per 1M token in output fino al 2026.
- Il modello sta arrivando su Spark ed è disponibile nell’intera gamma di prodotti AI per sviluppatori ed enterprise di Google.
Lancio di Gemini 3.7
Google ha annunciato Gemini 3.7 Flash il 13 agosto, appena tre settimane dopo Gemini 3.6 Flash. Il gruppo spiega che il rilascio è stato guidato dal feedback degli sviluppatori e da modifiche algoritmiche, con focus su ingegneria software, sviluppo web e attività di knowledge work. La cadenza di aggiornamento è insolitamente serrata.
I progressi più evidenti arrivano sul fronte del codice. DeepSWE v1.1 sale al 65,3%, rispetto a circa il 49% di 3.6 Flash, mentre FrontierCode 1.1 Main migliora dal 34,4% al 43,6%. Segnali positivi anche nello sviluppo web, dove il punteggio Elo nella WebDev Arena passa da 1538 a 1588.
Secondo Google, il modello «genera layout più funzionali e applicazioni complete di funzionalità con un numero inferiore di prompt». Migliorano anche i benchmark per il knowledge work: GDP.pdf sale dal 22,0% al 34,0%, mentre AutomationBench avanza dal 17,0% al 30,4%. Il gruppo ha inoltre aggiornato le misure di sicurezza per limitare gli abusi in ambito CBRN e nel cyber offense.
Da leggere anche: Anthropic punta a un accordo Decart da 6 miliardi di dollari in vista della quotazione in Borsa
Performance AI
I test indipendenti confermano il salto di qualità. Niko Grupen, responsabile della ricerca applicata di Harvey, riferisce che il modello migliora di 2,6 punti la performance “all-pass” rispetto a 3.6 Flash sul benchmark Legal Agent Bench. Kyrill Hux, cofondatore di Nunu.ai, sostiene che i loro benchmark collocano 3.7 Flash vicino ai modelli frontier di fascia media, ma a circa metà del costo.
I prezzi più bassi rafforzano questa tesi, perché gli agenti ad alto volume possono accumulare costi significativi con step di pianificazione ripetuti, chiamate a tool e retry. Google afferma che 3.7 Flash segue le istruzioni in modo più fedele e gestisce meglio i “blocchi di percorso”, riducendo potenzialmente la necessità di intervento umano nei flussi di lavoro ingegneristici e di business. Il modello è ora generalmente disponibile.
Gemini 3.6 Flash era stato lanciato il 21 luglio a 1,50 $ per 1M token in input e 7,50 $ per 1M token in output.
Tre settimane dopo, 3.7 Flash debutta a 0,75 $ e 3,75 $, rispettivamente, fino al 31 dicembre, migliorando al contempo le prestazioni nei benchmark e arrivando su Spark per gli abbonati AI Pro e Ultra. La rapida successione di release conferma il ciclo accelerato di aggiornamenti della linea Flash di Google.
Da leggere dopo: Il volume di scambio di Virtuals Protocol esplode del 180%, i rialzisti puntano a 0,68 $





