Google desarrolla chip Frozen v2 para codificar arquitectura Gemini en silicio; apunta a eficiencia de inferencia 6–10x para 2028
Google está desarrollando "Frozen v2", un chip específico de inferencia que incorpora la arquitectura de red neuronal de Gemini directamente en silicio, según fuentes citadas por The Information el 20 de julio. Se proyecta que el chip entregue 6 a 10 veces más tokens por vatio que la actual generación de Tensor Processing Units de Google (TPU 8i), con implementación prevista ya para 2028. A diferencia de los aceleradores de propósito general de NVIDIA o de la línea TPU del Google, Frozen v2 codificará la lógica estructural de Gemini en la circuitería del chip, eliminando sobrecarga en tiempo de ejecución para decisiones arquitectónicas.
El diseño cambia de un concepto anterior "completamente codificado" que habría congelado pesos de modelo (haciendo que el chip sea obsoleto con cada actualización de modelo) a un enfoque "codificado flexible" que bloquea solo la fundación arquitectónica estable. Esto preserva ganancias de eficiencia arquitectónica mientras mantiene un ciclo de vida de chip de múltiples años. El cuello de botella de computación interno de Google impulsó el proyecto; la empresa enfrenta limitaciones graves al servir Gemini a la escala requerida para cargas de trabajo actuales y planeadas.
Frozen v2 se posiciona como una pista paralela junto a la línea TPU de propósito general de Google, no como reemplazo. Una apuesta de capex de $2 mil millones sin cronograma confirmado, el proyecto intercambia versatilidad por especialización extrema—una apuesta de que la estructura transformer de Gemini permanece estable hasta 2028 y más allá. Si Gemini sufre una revisión arquitectónica importante (p. ej., cambio a modelos de espacio de estados), el hardware podría volverse parcialmente obsoleto.
Para planificadores de infraestructura: el movimiento de Google señala un cambio más amplio hacia silicio específico del modelo sobre aceleradores de propósito general. Los competidores sin integración vertical equivalente—incluyendo proveedores de nube que dependen de NVIDIA—enfrentan presión de margen si Frozen v2 llega a producción y reduce el costo de servir Gemini. Observe las ganancias Q2 de Alphabet (22 de julio) y cualquier divulgación pública sobre el estado del proyecto.
Fuentes
- Primary source
- techtimes.com
“Frozen v2 hardwires Gemini architecture, targets 6–10x tokens per watt over TPU 8i”
- techcrunch.com
“Google didn't confirm or deny the project; stock climbed 3% on The Information report”
- fourweekmba.com
“Frozen v2 bakes Gemini blueprint into silicon; 2028 deployment target”