AO VIVO · SEX., 31 DE JUL. DE 2026 --:--:-- ET
Edição Nº 101 GASTO TOTAL $15017.16 ARTIGOS HOJE 5 TOKENS TOTAL 9.74B
aiexpert
Na linha
Funding Startups de chip de IA arrecadaram $4,16B YTD 2026, 40× ritmo de 2025; rodada mediana atinge $350M Policy Departamento de Comércio concede $874M em fundos da Lei CHIPS para 7 empresas para P&D de semicondutores de IA Chips Roteiro de empilhamento 3D da CEA-Leti aborda gargalo de memória de IA com interconexões sub-micronicas Policy Departamento de Comércio concede $874M em incentivos de P&D da CHIPS Act para 7 empresas de infraestrutura de IA Policy Legisladores dos EUA exigem que DoorDash divulgue uso de modelos de IA chineses Market Fundo Situational Awareness de Aschenbrenner desaba de $45B para $10B em chamadas de margem, colapso de alavancagem Market Apple enfrenta 'enchente centenária' em preços de memória; inventário dobra para $11,09B Market Megacaps de tecnologia postam fluxo de caixa livre negativo; crise de memória forçando capex de 2026 mais alta Market Índice de semicondutores salta 8,5%–5,4% enquanto ganhos de Microsoft e Amazon revivem apetite por capex de IA Market Amazon aumenta capex 2026 para $220B em custos de memória; corrida Big Tech capex atinge $725B Funding Antora Energy fecha Série C de $550M em avaliação de $2.47B; baterias térmicas para poder de IA Chips Lumentum avisa que escassez de fosfeto de ínidio é pior que crise de DRAM; lacuna de 30% de supply se aproxima Market OpenAI corta GPT-5.6 Luna em 80%, undercutting rivais conforme guerra de preços intensifica Funding Zhongji Innolight arrecada HK$53,4B no maior IPO de Hong Kong desde 2019 em óptica para IA Market Lucro operacional da Samsung no Q2 2026 atinge ₩89,4T, aumento de 1.800% YoY impulsionado pela demanda de HBM para IA Breaking China ameaça retaliação enquanto FCC restringe importações de robôs humanoides por preocupações de cibersegurança Chips Escassez de chip IA sobe: afunilamento de embalagem CoWoS se aprofunda até 2028 Funding Quanta Computer busca $2,2B em venda de GDS enquanto demanda por servidores IA dispara Market Innolight arrecada $6,8 bilhões em listagem de Hong Kong; segundo maior IPO da Ásia em 2026 Market Meta negocia aluguel de compute de IA de $10B com Anthropic em meio a impulso de capex de $130B–$145B Funding Startups de chip de IA arrecadaram $4,16B YTD 2026, 40× ritmo de 2025; rodada mediana atinge $350M Policy Departamento de Comércio concede $874M em fundos da Lei CHIPS para 7 empresas para P&D de semicondutores de IA Chips Roteiro de empilhamento 3D da CEA-Leti aborda gargalo de memória de IA com interconexões sub-micronicas Policy Departamento de Comércio concede $874M em incentivos de P&D da CHIPS Act para 7 empresas de infraestrutura de IA Policy Legisladores dos EUA exigem que DoorDash divulgue uso de modelos de IA chineses Market Fundo Situational Awareness de Aschenbrenner desaba de $45B para $10B em chamadas de margem, colapso de alavancagem Market Apple enfrenta 'enchente centenária' em preços de memória; inventário dobra para $11,09B Market Megacaps de tecnologia postam fluxo de caixa livre negativo; crise de memória forçando capex de 2026 mais alta Market Índice de semicondutores salta 8,5%–5,4% enquanto ganhos de Microsoft e Amazon revivem apetite por capex de IA Market Amazon aumenta capex 2026 para $220B em custos de memória; corrida Big Tech capex atinge $725B Funding Antora Energy fecha Série C de $550M em avaliação de $2.47B; baterias térmicas para poder de IA Chips Lumentum avisa que escassez de fosfeto de ínidio é pior que crise de DRAM; lacuna de 30% de supply se aproxima Market OpenAI corta GPT-5.6 Luna em 80%, undercutting rivais conforme guerra de preços intensifica Funding Zhongji Innolight arrecada HK$53,4B no maior IPO de Hong Kong desde 2019 em óptica para IA Market Lucro operacional da Samsung no Q2 2026 atinge ₩89,4T, aumento de 1.800% YoY impulsionado pela demanda de HBM para IA Breaking China ameaça retaliação enquanto FCC restringe importações de robôs humanoides por preocupações de cibersegurança Chips Escassez de chip IA sobe: afunilamento de embalagem CoWoS se aprofunda até 2028 Funding Quanta Computer busca $2,2B em venda de GDS enquanto demanda por servidores IA dispara Market Innolight arrecada $6,8 bilhões em listagem de Hong Kong; segundo maior IPO da Ásia em 2026 Market Meta negocia aluguel de compute de IA de $10B com Anthropic em meio a impulso de capex de $130B–$145B
Market

OpenAI corta GPT-5.6 Luna em 80%, undercutting rivais conforme guerra de preços intensifica

OpenAI reduziu drasticamente os preços de dois modelos na sua lineup GPT-5.6 em 30 de julho, cortando Luna—o tier mais pequeno e rápido—em 80% para $0.20/$1.20 por milhão de tokens de entrada/saída, e Terra em 20% para $2/$12, deixando o flagship Sol inalterado. Os cortes chegaram apenas três semanas após o lançamento da família GPT-5.6 e refletem ganhos de eficiência em todo o sistema: o GPT-5.6 Sol reescreveu autonomamente seus próprios kernels de GPU de produção e modelos de decodificação especulativa, reduzindo custos de serving em 20–15% através de auto-otimização.

Luna agora oferece custo ~87% menor que o GPT-5.4 mini pela mesma capacidade de raciocínio—uma redução de 13x em quatro meses—e fica abaixo do Gemini 3.6 Flash do Google ($1.50/$7.50). O movimento undercuta rivais chineses DeepSeek V4 Pro em custos de entrada e visa compradores empresariais que haviam mudado para modelos mais baratos. O Claude Opus 5 do Anthropic em $5/$25 permanece mais capaz, mas mais caro; Google, Microsoft e Anthropic todos cortaram preços semanas antes, disparando a corrida.

Arquitetos devem notar a estratégia de tier duplo: Luna commoditiza inferência para workflows de alto volume (agentes, classificação, sumarização), enquanto um novo modo Sol Fast cobra 2× o preço padrão para até 2.5× throughput sem mudança de inteligência—monetizando latência separadamente. OpenAI sinalizou que isto é estrutural, não temporário: CEO Sam Altman disse que custos eram "uma questão enorme" e a empresa passaria ganhos de eficiência aos usuários. Para sistemas em produção, a base de custo de Luna agora rivaliza modelos open-weight mantendo raciocínio de nível frontier em benchmarks comuns.

Fontes