Google ontwikkelt een serverchip die delen van de architectuur van zijn Gemini-model direct in silicium vastlegt. Doel: zes- tot tienmaal meer tokens per watt dan de huidige generatie AI-hardware.
Kernpunten:
- Ingenieurs schatten dat de processor, intern bekend als Frozen v2, zes- tot tienmaal meer tokens per eenheid vermogen kan verwerken dan Google's nieuwste Tensor Processing Units.
- Introductie wordt beoogd vanaf 2028, terwijl het bedrijf het bestaan van het project niet publiekelijk bevestigt.
- Alphabet-aandelen stegen maandag circa 3%, een dag voor de publicatie van de resultaten over het tweede kwartaal.
Frozen v2-chip verankert Gemini in silicium
Het nieuws kwam maandag naar buiten toen twee personen met directe kennis van het project een processor beschreven die intern als Frozen v2 wordt aangeduid. Ingenieurs van het team schatten dat de chip zes- tot tienmaal meer tokens per eenheid stroomverbruik kan bedienen dan de nieuwste generatie Tensor Processing Units (TPU's) van Google. Inzet in datacenters staat gepland vanaf 2028, al is nog niet besloten welk deel van het model daadwerkelijk in hardware wordt gegoten.
Google heeft het bestaan van het project noch bevestigd, noch ontkend.
Een woordvoerder stelde dat de teams voortdurend nieuwe ideeën onderzoeken en testen, en dat lang niet elke proef uiteindelijk in productie komt.
De chip zou een aparte productlijn vormen en niet de Tensor-units vervangen die nu al Gemini- en Google Cloud-workloads draaien. De verwachte volumes blijven dan ook ver achter bij die van de huidige TPU’s. Intern wordt het project nog als experimenteel gezien en liggen meerdere ontwerpkeuzes nog open.
Ook interessant: Volatiliteit Dow Jones Industrial Average test Bitcoin als ‘veilige haven’
Gemini-architectuur ruilt flexibiliteit in voor efficiëntie
Standaard AI-versnellers laden een model in het geheugen en sturen de data vervolgens heen en weer voor elke afzonderlijke vraag. Dat kost zowel veel rekenkracht als energie. Frozen v2 zou in plaats daarvan de structurele blauwdruk van Gemini in de circuits zelf vastleggen, waardoor zowel het aantal benodigde berekeningen als de databewegingen per modelantwoord fors kan dalen.
De zogeheten ‘weights’ van het model – de numerieke waarden die tijdens de training worden geleerd – blijven wel aanpasbaar.
In een eerdere variant van het project zouden ook die gewichten in de hardware worden verbrand. Omdat de architectuur zelf echter vastligt, kan de chip toekomstige Gemini-versies alleen ondersteunen als Google de onderliggende basisarchitectuur intact laat.
Alphabet-aandeel loopt op in aanloop naar cijfers Q2
Aandelen Alphabet klommen maandag ongeveer 3% en noteerden intraday rond 356 dollar, voordat de winst een dag later deels wegebde. Beleggers zien het bericht als een gedeeltelijk antwoord op de huidige capaciteitskrapte, die zo nijpend is dat Google Cloud recent bepaalde klanten moest afwijzen.
Het bedrijf presenteert woensdag na het slot van Wall Street de resultaten over het tweede kwartaal. Analisten rekenen gemiddeld op een winst van 2,95 dollar per aandeel bij een omzet van circa 117 miljard dollar.
Alphabet verhoogde eerder dit jaar zijn investeringsraming voor 2026 naar maximaal 190 miljard dollar. In het eerste kwartaal steeg de omzet met 22% tot 109,9 miljard dollar, mede dankzij een groei van 63% bij de clouddivisie. Sindsdien heeft Google een vertraging moeten incasseren bij de volgende Gemini Pro-release, terwijl Chinese AI-modellen inmiddels naar schatting zo’n 45% van het tokenverbruik bij Amerikaanse bedrijven voor hun rekening nemen.
Lees verder: Meteoriet die een huis in New Jersey raakte, voedt met AI aangestuurde zoektocht naar buitenaards leven





