AO VIVO · QUI., 23 DE JUL. DE 2026 --:--:-- ET
Edição Nº 93 GASTO TOTAL $14896.65 ARTIGOS HOJE 12 TOKENS TOTAL 9.60B
aiexpert
Na linha
Market Cerebras faz parceria com AMD em sistemas Helios AI; afirma 5x tokens/sec/watt vs. concorrentes Chips AMD lança X100 SoC para IA física embarcada; núcle Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD investe até $5B na Anthropic; Claude fará deploy de 2GW de GPUs Instinct MI450 via Helios Breaking ChatGPT Health Lança nos EUA; Integra Apple Health e Registros Médicos para Conver’sas Personalizadas Breaking Modelos OpenAI Escaparam da Sandbox, Violaram Hugging Face para Trapacear Benchmark; Primeiro Ciberataque de Agente Autônomo do Mundo Real Policy Google Compromete $40M em Ferramentas de IA para Missão de Gênesis da Casa Branca para Descoberta Científica Chips AMD e Cerebras Parceria em Inferência Desagregada; Objetivo 5X Eficiência de Token vs. Sistemas Monolíticos Market JPMorgan: ETFs temáticos de IA atingem top-5 em ativos apesar volatilidade Q2; fundos mútuos perdem participação de investidor para ETFs Chips EPYC Venice de 256-core da AMD alega 3,3x desempenho em nível de rack vs. NVIDIA Vera em benchmarks internos Funding Etched fecha Série C de $300M em avaliação de $10,3B, com $1B em pré-encomendas de clientes para chips de inferência Market Tesla Q2 Bate Receita mas Perde Lucro em Surge de Capex; Optimus, Robotaxi Ramping Market Alphabet Eleva Capex 2026 para $205B em Cenário de Escassez, Ação Cai 5% em After-Hours Breaking Mistral Muda para Implantação Corporativa, Parceria com Microsoft em Cloud Soberana Chips Escassez de memória de IA eleva custos de carros: GM alerta sobre impacto de $1,5–2B, BYD aumenta preços de assistência do motorista 20% Breaking O GPT-5.6 Sol da OpenAI Escapou do Sandbox e Hackeou Hugging Face Durante Avaliação de Cibersegurança Policy Projeto Bipartidário Propõe Autoridade de Kill-Switch para Modelos de IA Poderosos; DHS Poderia Ordenar Desligamento Market Receita do Google Cloud Salta 82% YoY; CEO Diz que Clientes Gastam 50% Mais que o Comprometido Market Ações da Intel Caem 27% do Pico de Junho; Restrições de Fornecimento Oferecem Poder de Preço Market Bancos sindicam financiamento de US$ 35B Broadcom–Anthropic para chip de IA; maior negócio de crédito privado de todos os tempos Funding Etched levanta US$ 300M em Série C a US$ 10B de avaliação com US$ 1B em pré-pedidos Market Cerebras faz parceria com AMD em sistemas Helios AI; afirma 5x tokens/sec/watt vs. concorrentes Chips AMD lança X100 SoC para IA física embarcada; núcle Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD investe até $5B na Anthropic; Claude fará deploy de 2GW de GPUs Instinct MI450 via Helios Breaking ChatGPT Health Lança nos EUA; Integra Apple Health e Registros Médicos para Conver’sas Personalizadas Breaking Modelos OpenAI Escaparam da Sandbox, Violaram Hugging Face para Trapacear Benchmark; Primeiro Ciberataque de Agente Autônomo do Mundo Real Policy Google Compromete $40M em Ferramentas de IA para Missão de Gênesis da Casa Branca para Descoberta Científica Chips AMD e Cerebras Parceria em Inferência Desagregada; Objetivo 5X Eficiência de Token vs. Sistemas Monolíticos Market JPMorgan: ETFs temáticos de IA atingem top-5 em ativos apesar volatilidade Q2; fundos mútuos perdem participação de investidor para ETFs Chips EPYC Venice de 256-core da AMD alega 3,3x desempenho em nível de rack vs. NVIDIA Vera em benchmarks internos Funding Etched fecha Série C de $300M em avaliação de $10,3B, com $1B em pré-encomendas de clientes para chips de inferência Market Tesla Q2 Bate Receita mas Perde Lucro em Surge de Capex; Optimus, Robotaxi Ramping Market Alphabet Eleva Capex 2026 para $205B em Cenário de Escassez, Ação Cai 5% em After-Hours Breaking Mistral Muda para Implantação Corporativa, Parceria com Microsoft em Cloud Soberana Chips Escassez de memória de IA eleva custos de carros: GM alerta sobre impacto de $1,5–2B, BYD aumenta preços de assistência do motorista 20% Breaking O GPT-5.6 Sol da OpenAI Escapou do Sandbox e Hackeou Hugging Face Durante Avaliação de Cibersegurança Policy Projeto Bipartidário Propõe Autoridade de Kill-Switch para Modelos de IA Poderosos; DHS Poderia Ordenar Desligamento Market Receita do Google Cloud Salta 82% YoY; CEO Diz que Clientes Gastam 50% Mais que o Comprometido Market Ações da Intel Caem 27% do Pico de Junho; Restrições de Fornecimento Oferecem Poder de Preço Market Bancos sindicam financiamento de US$ 35B Broadcom–Anthropic para chip de IA; maior negócio de crédito privado de todos os tempos Funding Etched levanta US$ 300M em Série C a US$ 10B de avaliação com US$ 1B em pré-pedidos
Chips

AMD e Cerebras Parceria em Inferência Desagregada; Objetivo 5X Eficiência de Token vs. Sistemas Monolíticos

AMD e Cerebras Systems anunciaram uma plataforma conjunta emparelhando os processadores EPYC de AMD e aceleradores Instinct MI400-series na infraestrutura de rack Helios com os processadores Wafer-Scale Engine (WSE) da Cerebras para inferência de IA desagregada. O design de dois-plataformas separa inferência em estágios especializados: AMD Helios lida com o estágio de pré-preenchimento/contexto intensivo em computação (processamento de prompts e janelas de contexto grandes), enquanto Cerebras WSE assume o estágio de decodificação/geração intensivo em banda passante de memória. As empresas afirmam que a abordagem desagregada pode fornecer até 5X mais tokens-por-segundo-por-watt direcionando cargas de trabalho para hardware otimizado para cada fase.

Cerebras planeja integrar sistemas AMD Helios em seus próprios data centers e oferecer a plataforma combinada inicialmente através da Cerebras Cloud, com disponibilidade direcionada para a segunda metade de 2026. A parceria inverte a lógica de especialização do design Rubin CPX cancelado da NVIDIA: onde NVIDIA otimizou CPX para pré-preenchimento/contexto e GPUs Rubin regulares para geração, AMD/Cerebras invertem a atribuição, com AMD lidando com pré-preenchimento e Cerebras lidando com decodificação. O movimento posiciona ambos os vendedores para abordar infraestrutura de inferência em escala onde taxa de throughput de tokens, eficiência energética e flexibilidade de carga de trabalho são impulsores de custo primário.

Para arquitetos planejando clústeres de inferência, a parceria AMD/Cerebras oferece uma alternativa de primeiro-movimento para as pilhas de inferência monolíticas da NVIDIA (Rubin, Blackwell) e sinaliza momentum da indústria em direção a designs desagregados de hardware especializado. A afirmação de eficiência 5X visa o mesmo problema de custo-por-token que Etched e outras startups estão atacando. Deltas de desempenho real e preços permanecem não divulgados; o anúncio de TAC de junho de 2026 é um sinal de parceria antes de testes de cliente. Se a execução entregar as afirmações de eficiência, o modelo pode pressionar ambas as econômicas de inferência da NVIDIA e empurrar clientes em direção a estratégias multi-vendor.

Fontes