Google desenvolve chip Frozen v2 para codificar arquitetura Gemini em silício; almeja eficiência de inferência 6–10x até 2028
Google está desenvolvendo "Frozen v2", um chip específico de inferência que incorpora a arquitetura de rede neural de Gemini diretamente em silício, de acordo com fontes citadas pela The Information em 20 de julho. O chip é projetado para entregar 6 a 10 vezes mais tokens por watt do que a geração atual de Tensor Processing Units do Google (TPU 8i), com implantação alvo já em 2028. Diferente dos aceleradores de propósito geral de NVIDIA ou da linha TPU do Google, Frozen v2 codificará a lógica estrutural de Gemini na circuiteria do chip, eliminando sobrecarga de tempo de execução para decisões arquiteturais.
O design muda de um conceito anterior "totalmente codificado" que teria congelado pesos do modelo (tornando o chip obsoleto a cada atualização de modelo) para uma abordagem "codificada flexível" que bloqueia apenas a fundação arquitetural estável. Isso preserva ganhos de eficiência arquitetural mantendo um ciclo de vida de chip de múltiplos anos. O gargalo de computação interno do Google impulsionou o projeto; a empresa enfrenta sérios gargalos ao servir Gemini na escala necessária para cargas de trabalho atuais e planejadas.
Frozen v2 é posicionado como uma faixa paralela à linha TPU de propósito geral do Google, não como substituto. Uma aposta de $2 bilhões em capex sem cronograma confirmado, o projeto troca versatilidade por especialização extrema—uma aposta de que a estrutura transformer de Gemini permanece estável até 2028 e além. Se Gemini sofrer revisão arquitetural importante (p.ex., mudança para modelos de espaço de estado), o hardware poderia se tornar parcialmente obsoleto.
Para planejadores de infraestrutura: o movimento do Google sinaliza uma mudança mais ampla em direção a silício específico de modelo sobre aceleradores de propósito geral. Competidores sem integração vertical equivalente—incluindo provedores de nuvem dependentes de NVIDIA—enfrentam pressão de margem se Frozen v2 atingir produção e baixar o custo de atendimento de Gemini. Observe os ganhos Q2 da Alphabet (22 de julho) e qualquer divulgação pública sobre o status do projeto.
Fontes
- Primary source
- techtimes.com
“Frozen v2 hardwires Gemini architecture, targets 6–10x tokens per watt over TPU 8i”
- techcrunch.com
“Google didn't confirm or deny the project; stock climbed 3% on The Information report”
- fourweekmba.com
“Frozen v2 bakes Gemini blueprint into silicon; 2028 deployment target”