Según The Information, Google está desarrollando Frozen v2, un nuevo chip de servidor de IA que integra directamente la arquitectura subyacente de Gemini en el silicio para impulsar la eficiencia de la inferencia hasta 10 veces. A diferencia de chips de propósito general como las GPU y de las propias TPU de Google, Frozen v2 sacrifica la versatilidad a favor de una mayor eficiencia de inferencia y un menor consumo de energía al codificar de forma fija la arquitectura del modelo en el hardware.
El proyecto surge por la aguda escasez de capacidad de cómputo de IA de Google, que ha tensionado los recursos internos de GPU y TPU y ha afectado a algunos clientes de Google Cloud. Google ya ha acordado pagar a SpaceX aproximadamente 1000 millones de dólares al mes por la capacidad de cómputo de IA proporcionada por xAI para cubrir el déficit de infraestructura.