Google ha lanciato Gemini 3.7 Flash tre settimane dopo la 3.6, con un punteggio DeepSWE del 65,3% e un prezzo di lancio pari alla metà rispetto al debutto del modello precedente.
Punti chiave:
- Gemini 3.7 Flash porta il punteggio DeepSWE v1.1 al 65,3% e raggiunge 1588 Elo nello sviluppo web.
- Il pricing introduttivo è di 0,75 dollari per 1M token in input e 3,75 dollari per 1M token in output fino al 2026.
- Il modello è in fase di rollout su Spark ed è disponibile in tutta l’offerta AI per sviluppatori e imprese di Google.
Lancio di Gemini 3.7
Google ha annunciato Gemini 3.7 Flash il 13 agosto, a soli tre settimane dal rilascio di Gemini 3.6 Flash. L’azienda attribuisce l’uscita ravvicinata al feedback degli sviluppatori e a modifiche algoritmiche, con un focus su ingegneria software, sviluppo web e knowledge work. Il ritmo di rilascio è insolitamente serrato.
I progressi più evidenti emergono nel coding. DeepSWE v1.1 sale al 65,3%, da circa il 49% di 3.6 Flash, mentre FrontierCode 1.1 Main passa dal 34,4% al 43,6%. Migliora anche lo sviluppo web: il punteggio Elo di WebDev Arena cresce da 1538 a 1588.
Secondo Google, il modello «genera layout più funzionali e applicazioni complete di funzionalità con meno prompt». Avanzano anche i benchmark sul lavoro cognitivo: GDP.pdf sale dal 22,0% al 34,0%, mentre AutomationBench passa dal 17,0% al 30,4%. Il gruppo ha inoltre introdotto nuove salvaguardie contro l’uso improprio in ambito CBRN e per attività di cyber offense.
Da leggere anche: Anthropic punta a un accordo Decart da 6 miliardi di dollari in vista della quotazione
Performance AI
Test indipendenti confermano il salto di qualità. Niko Grupen, responsabile ricerca applicata presso Harvey, indica un miglioramento di 2,6 punti nella “all-pass performance” rispetto a 3.6 Flash su Legal Agent Bench. Kyrill Hux, cofondatore di Nunu.ai, afferma che, secondo i loro benchmark, 3.7 Flash si avvicina ai modelli frontier di fascia media, a circa metà del costo.
Il taglio dei prezzi rafforza questa tesi, perché gli agenti ad alto volume possono generare costi significativi attraverso iterazioni di pianificazione, chiamate a tool e retry ripetuti. Google sostiene che 3.7 Flash segua le istruzioni in modo più rigoroso e gestisca meglio gli ostacoli, con il potenziale di ridurre l’intervento manuale nei flussi di lavoro di ingegneria e business. Il modello è disponibile in generale availability.
Gemini 3.6 Flash era stato lanciato il 21 luglio a 1,50 dollari per 1M token in input e 7,50 dollari per 1M token in output.
Tre settimane dopo, 3.7 Flash debutta a 0,75 e 3,75 dollari rispettivamente, fino al 31 dicembre, ampliando al contempo le performance sui benchmark e arrivando su Spark per gli abbonati AI Pro e Ultra. La sequenza così ravvicinata conferma il ciclo accelerato di aggiornamenti Flash di Google.
Prossimo articolo: Volume di trading di Virtuals Protocol esplode del 180%, i rialzisti puntano a 0,68 dollari





