Google heeft woensdag Gemini 3.8 Flash gelanceerd, een nieuw taalmodel dat 59 scoort op een onafhankelijke intelligentie‑index, terwijl de gebruikskosten per token ruim onder die van toonaangevende concurrenten blijven. Daarnaast introduceert het bedrijf een streng afgeschermde cybersecurity‑variant.
Belangrijkste punten:
- Gemini 3.8 Flash behaalt 59 op de Artificial Analysis Intelligence Index, drie punten hoger dan de versie die drie weken eerder verscheen.
- De tokenprijzen blijven tot en met 31 december op $0,75 en $3,75 per miljoen, al liggen de kosten per taak circa 40% boven het vorige model.
- Een aparte cybersecurity‑variant is alleen beschikbaar voor gescreende overheden, vitale‑infrastructuurbeheerders en software‑maintainers via het nieuwe Fairwind‑programma.
Benchmarkresultaten Gemini 3.8 Flash
Het bedrijf introduceerde beide varianten op 2 september. Het is de derde Flash‑release in zes weken tijd. Ze zijn gebaseerd op één kernsysteem dat intensief is getraind op cybersecurity‑taken.
Eén model richt zich op codeerwerk en agent‑taken; de andere variant speurt onder strikte toegangsvoorwaarden naar kwetsbaarheden in omvangrijke codebases.
In de stand met verhoogde redeneercapaciteit scoort het model 59 op de Artificial Analysis Intelligence Index, drie punten meer dan 3.7 Flash en op hetzelfde niveau als GPT‑5.6 Sol en Grok 4.6. Op HLE‑Verified, een benchmark voor meerstapsredeneren in wetenschap, geesteswetenschappen en professionele domeinen, haalt Gemini 54,9%. Google wijst vooral op software‑engineering op de langere termijn als duidelijkste sprong voorwaarts.
De introductietarieven blijven tot en met 31 december staan op $0,75 per miljoen inputtokens en $3,75 per miljoen outputtokens. Op Nieuwjaarsdag verdubbelen beide bedragen.
Ook interessant: Claude Fable 5.1 lanceert met $0,25 cache‑reads en anti‑kopie‑controles
Waarom Gemini meer per taak kost
Lagere tokenprijzen betekenen niet automatisch lagere kosten per opdracht. In de praktijk komt Gemini 3.8 Flash uit op circa $0,58 per benchmarktaak, zo’n 40% hoger dan zijn voorganger. Dat komt doordat de gemiddelde output met ongeveer 30% is toegenomen tot 48.000 tokens en omdat agent‑runs meer interactierondes vergen. Vlaggenschipconcurrent Anthropic rekent per taak bijna zes keer zoveel, waardoor het Google‑model desondanks aan de kostenvoorhoede blijft.
Volgens Tulsee Doshi, senior product director, en Raluca Ada Popa, security‑verantwoordelijke voor Gemini bij Google DeepMind, “werkt” het model simpelweg harder: het voegt extra redeneerstappen toe en roept herhaaldelijk tools aan. Teams die het oude kostenprofiel willen behouden, kunnen op 3.7 Flash blijven. Pro‑ en Ultra‑abonnees krijgen via de Gemini‑app, in AI‑modus en in Google Sheets toegang tot de nieuwe versie.
Fairwind‑programma schermt cybermodel af
De security‑variant wordt uitsluitend aangeboden via het nieuwe Fairwind‑programma, dat openstaat voor gescreende overheden, beheerders van kritieke infrastructuur en verantwoordelijken voor software‑onderhoud.
In een interne test over 20 programmeertalen identificeerde het model kwetsbaarheden met een succesratio van meer dan 70%. Volgens Google leverde het Chrome‑securityteam met Gemini 2,6 keer zoveel correcte patches op als met aanzienlijk grotere commerciële rivalen. Een cloudonderzoeksteam wist met het model binnen twee uur een kritieke kwetsbaarheid te herleiden, een klus die normaal maanden in beslag neemt.
De hoge uitrolfrequentie komt na een lastige periode voor de AI‑tak van Google, waarin een geplande junilancering van Gemini 3.5 Pro niet werd gehaald.
Demis Hassabis is begin augustus teruggetreden als CEO van DeepMind en werd chairman; Koray Kavukcuoglu nam de dagelijkse leiding over, zij het met de lagere titel van senior vice president.
Lees verder: Bitcoin‑ETF’s zuigen $216,7 miljoen op en maken één sessie aan uitstroom ongedaan





