Google busca aumentar la eficiencia energética al grabar directamente la arquitectura del modelo de IA Gemini en los transistores del chip. Este chip, denominado por los desarrolladores 'Frozen v2', tiene como objetivo ofrecer entre 6 y 10 veces más capacidad de procesamiento de tokens por unidad de potencia en comparación con los TPUs actuales. Este diseño fija la arquitectura del modelo, no sus pesos, lo que permite mantener la compatibilidad con diferentes versiones de Gemini.
El proyecto anterior 'Frozen' tenía como objetivo incrustar completamente los pesos del modelo en el chip, pero esta aproximación fue descartada debido a su dependencia de una única versión del modelo, lo que lo hacía potencialmente obsoleto rápidamente. Frozen v2, en cambio, fija la arquitectura mientras mantiene los pesos actualizables, lo que garantiza que el chip permanezca compatible con futuras actualizaciones de Gemini.
Google considera Frozen v2 como una experiencia dentro de su estrategia de hardware especializado, no como una reemplazo masivo de los TPUs. El chip podría lanzarse en 2028, coincidiendo con el mismo año en que Intel firmó un contrato para empaquetar más de tres millones de unidades de TPU. Tecnologías similares ya están siendo probadas por empresas como Taalas.
