Google ontwikkelt een nieuwe serverchip die delen van het Gemini-model rechtstreeks in de hardware vastlegt. De chip, informeel ‘Frozen v2’ genoemd, moet Gemini efficiënter kunnen serveren en Google helpen bij een nijpend tekort aan AI-rekenkracht. Uitrol staat gepland voor 2028.
Dat meldt The Information op basis van bronnen. Volgens de berichtgeving kan de chip zes tot tien keer efficiënter zijn dan Google’s nieuwste custom AI-chips, gemeten in het aantal AI-tokens dat per eenheid stroom wordt geserveerd. Engineers werken nog aan het ontwerp en aan de vraag hoeveel modelinformatie precies wordt vastgelegd. Het getal is dus een projectie, geen gemeten prestatie.
Aanvulling op de TPU’s, geen vervanging
Frozen v2 valt onder het bredere ‘Frozen’-project, dat draait om een nieuwe lijn eigen chips naast Google’s tensor processing units (TPU’s). Het is nadrukkelijk geen vervanger daarvan. Google zet de laatste jaren juist flink in op zijn TPU-familie. Zo introduceerde het bedrijf eerder de Ironwood TPU, een op inferencing gerichte chip die tot bijna 10.000 exemplaren in één pod schaalt en onder meer Gemini 2.5 draait.
Recenter presenteerde Google op Cloud Next twee nieuwe TPU’s, waarbij training (8t) en inferencing (8i) van elkaar zijn gescheiden. Frozen v2 zou daar dus bovenop komen als sterk gespecialiseerde optie voor Gemini-specifieke inferencing.
Google worstelt met een tekort aan AI-rekenkracht dat interne spanningen voedt en Google Cloud ertoe heeft gebracht deals met externe klanten af te wijzen.