AO VIVO · QUA., 29 DE JUL. DE 2026 --:--:-- ET
Edição Nº 99 GASTO TOTAL $14985.37 ARTIGOS HOJE 2 TOKENS TOTAL 9.71B
aiexpert
Na linha
Policy xAI processa Minnesota sobre proibição de nudificação de IA; lei entra em vigor 1º de agosto Policy Juiz aprova acordo de direitos autorais de $1,5 bi da Anthropic; autores recebem ~$3.100 por obra Chips AMD e Cerebras se unem em inferência de IA desagregada; reclamam ganhos de eficiência de 5x Funding Lattice Semiconductor conclui aquisição da AMI por $650M em ações Market Lucro Q2 da SK Hynix salta 557% YoY com demanda por HBM; receita fica abaixo das estimativas em razão de atrasos de precificação Market Volatilidade de chips atinge máxima de 30 anos conforme Cramer pede fuga de vencedores de memória para bancos, industriais Market Bloom Energy Q2 esmagador às expectativas, aumenta orientação de FY26 para $4B+ em demanda de poder de IA Breaking Allen AI lança plataforma OlmoEarth para inferência geospacial em escala continental; modelos de 10TB de satélite Breaking Together AI lança roteamento de tráfego ciente de capacidade para inferência de modelo multi-implementação Market Bloom Energy Q2 supera expectativas e eleva guidance do ano fiscal de 2026 para receita de $3,9–4,2B Chips NVIDIA Jetson T3000/T2000: Módulos Thor Alimentados por Blackwell para Escala de Robótica de Borda Breaking Moonshot Kimi K3: EUA Alegam Distilação, China Nega; Lacuna de Evidência de 15 Dias Emerge Breaking Sam Altman: Incidente de Segurança de IA Catalisa Repensa de Ritmo de Desenvolvimento Research AI2 lança OlmoEarth: modelos de fundação geoespacial de código aberto superando alternativas comerciais maiores Chips Huang da Nvidia: indústria de semicondutores deve crescer 10x para alimentar 100 bilhões de agentes de IA Breaking Grafana Assistant Agora Consulta 30+ Fontes de Dados via Linguagem Natural Research OpenAI publica relatório de campo: agentes de codificação aceleram modernização de software científico em genômica e ciências da vida Research Liquid AI lança codificadores eficientes em CPU LFM2.5: modelos 230M/350M superam alternativas maiores em tarefas de contexto longo Market Apple brevemente toca $5 trilhões de capitalização de mercado, ultrapassa Nvidia em debate de capex de IA Funding Mate Security fecha $35M em Série A, alcançando $50M total; crescimento de 500% desde Q3 2025 Policy xAI processa Minnesota sobre proibição de nudificação de IA; lei entra em vigor 1º de agosto Policy Juiz aprova acordo de direitos autorais de $1,5 bi da Anthropic; autores recebem ~$3.100 por obra Chips AMD e Cerebras se unem em inferência de IA desagregada; reclamam ganhos de eficiência de 5x Funding Lattice Semiconductor conclui aquisição da AMI por $650M em ações Market Lucro Q2 da SK Hynix salta 557% YoY com demanda por HBM; receita fica abaixo das estimativas em razão de atrasos de precificação Market Volatilidade de chips atinge máxima de 30 anos conforme Cramer pede fuga de vencedores de memória para bancos, industriais Market Bloom Energy Q2 esmagador às expectativas, aumenta orientação de FY26 para $4B+ em demanda de poder de IA Breaking Allen AI lança plataforma OlmoEarth para inferência geospacial em escala continental; modelos de 10TB de satélite Breaking Together AI lança roteamento de tráfego ciente de capacidade para inferência de modelo multi-implementação Market Bloom Energy Q2 supera expectativas e eleva guidance do ano fiscal de 2026 para receita de $3,9–4,2B Chips NVIDIA Jetson T3000/T2000: Módulos Thor Alimentados por Blackwell para Escala de Robótica de Borda Breaking Moonshot Kimi K3: EUA Alegam Distilação, China Nega; Lacuna de Evidência de 15 Dias Emerge Breaking Sam Altman: Incidente de Segurança de IA Catalisa Repensa de Ritmo de Desenvolvimento Research AI2 lança OlmoEarth: modelos de fundação geoespacial de código aberto superando alternativas comerciais maiores Chips Huang da Nvidia: indústria de semicondutores deve crescer 10x para alimentar 100 bilhões de agentes de IA Breaking Grafana Assistant Agora Consulta 30+ Fontes de Dados via Linguagem Natural Research OpenAI publica relatório de campo: agentes de codificação aceleram modernização de software científico em genômica e ciências da vida Research Liquid AI lança codificadores eficientes em CPU LFM2.5: modelos 230M/350M superam alternativas maiores em tarefas de contexto longo Market Apple brevemente toca $5 trilhões de capitalização de mercado, ultrapassa Nvidia em debate de capex de IA Funding Mate Security fecha $35M em Série A, alcançando $50M total; crescimento de 500% desde Q3 2025
Chips

AMD e Cerebras se unem em inferência de IA desagregada; reclamam ganhos de eficiência de 5x

AMD e Cerebras anunciaram uma parceria técnica para fornecer uma plataforma desagregada de inferência de IA combinando sistemas rackscale AMD Helios com o Cerebras Wafer-Scale Engine (WSE). Revelada no Advancing AI 2026 em 23 de julho, a solução conjunta emparelha o Helios de alto rendimento da AMD (72 GPUs MI455X por rack, 31TB HBM4) com o WSE-3 de ultra-baixa latência da Cerebras (900.000 núcleos, 44GB SRAM on-die). Juntos, eles afirmam até 5x maiores tokens por segundo por watt versus configurações WSE apenas da Cerebras.

AMD Helios lía o estágio de contexto/preenchimento—processando prompts e grandes janelas de contexto em alto rendimento—enquanto Cerebras WSE acelera o estágio de decodificação/geração intensiva de memória com latência sub-10ms por token. Essa abordagem desagregada espelha a estratégia NVIDIA Rubin CPX, mas inverte a especialização: AMD visa rendimento, Cerebras visa latência. O resultado é posicionado para aplicações priorizando interação em tempo real: copiões, agentes ao vivo, fluxos de trabalho autônomos e descoberta científíca.

Cerebras planeja implantar AMD Helios em seus próprios data centers, com a solução conjunta esperada estar disponível inicialmente por meio da Cerebras Cloud em H2 2026. Para arquitetos: essa parceria aborda um gargalo real—NVIDIA Rubin também buscou desagregação pela mesma razão. A questão para compradores é a paridade de recursos e o ecossistema de software. AMD e Cerebras devem demonstrar que a inferência mista entre Helios + WSE corresponde à facilidade de pilhas de fornecedor único, particularmente para equipes migrando de NVIDIA.

Fontes