AO VIVO · QUA., 29 DE JUL. DE 2026 --:--:-- ET
Edição Nº 99 GASTO TOTAL $14995.52 ARTIGOS HOJE 13 TOKENS TOTAL 9.72B
aiexpert
Na linha
Chips Memória LPDDR e SOCAMM ganham tração em data centers de IA conforme abastecimento de HBM se aperta Policy Sam Altman se reúne com chefe de gabinete da Casa Branca enquanto prazo do framework de IA de Trump se aproxima de 1º de agosto Breaking LangChain Deep Agents v0.7: corte de tokens base de 65% via harness de prompt refinado; todos opt-in, override de middleware Funding CoreWeave aumenta rendimento em empréstimo de $2,6B vinculado à Anthropic via spreads de preços mais amplos Market Microsoft Q4 earnings hoje; orientação capex FY2027 esperada $255–260B (+35% YoY) Chips Seagate qualificará discos HAMR de 50TB no final de 2027, com embarque em 2028 Market Orientação de capex do FY2027 da Microsoft provavelmente $255–260B; gasto de infraestrutura de IA sobe 35% YoY Market Meta Q2 capex esperado para dobrar Y/Y conforme orientação de $125–145B em todo o ano se aproxima no relatório de resultados Chips AMD lança Helios rack; 15% mais compute, 30% melhor tokens/dólar que Vera Rubin Market Seagate Q4 supera estimativas; orienta receita Q1 de $4,1B em demanda de armazenamento IA Market NVIDIA aumenta preços de GPU RTX em 20–30% no terceiro aumento de 2026; escassez de GDDR esperada até 2028 Chips Funcionário da NVIDIA detido em Taiwan por esquema de contrabando Supermicro; desvio de GPU persiste apesar da whitelist Market Apple atinge avaliação de $5T; última chamada de lucros de Tim Cook enfrenta crise de memória + pressão de estratégia de IA Chips Lenovo dobra instalação de IA em Whitsett NC para 890K sq ft; visa 1.400 nodes/dia de capacidade Market Meta parceria BlackRock em data center El Paso de $14B; BlackRock é proprietária de 80%, Meta opera Market Bloom Energy supera Q2, aumenta guidance FY para $3.9–4.2B com demanda de células de combustível em data centers AI Funding Centralize levanta $15M em Série A para mapear relacionamentos em negócios enterprise com IA Market Ações de semicondutores asiáticos desabam; SK Hynix erra estimativas apesar de lucro recorde Policy xAI processa Minnesota sobre proibição de nudificação de IA; lei entra em vigor 1º de agosto Policy Juiz aprova acordo de direitos autorais de $1,5 bi da Anthropic; autores recebem ~$3.100 por obra Chips Memória LPDDR e SOCAMM ganham tração em data centers de IA conforme abastecimento de HBM se aperta Policy Sam Altman se reúne com chefe de gabinete da Casa Branca enquanto prazo do framework de IA de Trump se aproxima de 1º de agosto Breaking LangChain Deep Agents v0.7: corte de tokens base de 65% via harness de prompt refinado; todos opt-in, override de middleware Funding CoreWeave aumenta rendimento em empréstimo de $2,6B vinculado à Anthropic via spreads de preços mais amplos Market Microsoft Q4 earnings hoje; orientação capex FY2027 esperada $255–260B (+35% YoY) Chips Seagate qualificará discos HAMR de 50TB no final de 2027, com embarque em 2028 Market Orientação de capex do FY2027 da Microsoft provavelmente $255–260B; gasto de infraestrutura de IA sobe 35% YoY Market Meta Q2 capex esperado para dobrar Y/Y conforme orientação de $125–145B em todo o ano se aproxima no relatório de resultados Chips AMD lança Helios rack; 15% mais compute, 30% melhor tokens/dólar que Vera Rubin Market Seagate Q4 supera estimativas; orienta receita Q1 de $4,1B em demanda de armazenamento IA Market NVIDIA aumenta preços de GPU RTX em 20–30% no terceiro aumento de 2026; escassez de GDDR esperada até 2028 Chips Funcionário da NVIDIA detido em Taiwan por esquema de contrabando Supermicro; desvio de GPU persiste apesar da whitelist Market Apple atinge avaliação de $5T; última chamada de lucros de Tim Cook enfrenta crise de memória + pressão de estratégia de IA Chips Lenovo dobra instalação de IA em Whitsett NC para 890K sq ft; visa 1.400 nodes/dia de capacidade Market Meta parceria BlackRock em data center El Paso de $14B; BlackRock é proprietária de 80%, Meta opera Market Bloom Energy supera Q2, aumenta guidance FY para $3.9–4.2B com demanda de células de combustível em data centers AI Funding Centralize levanta $15M em Série A para mapear relacionamentos em negócios enterprise com IA Market Ações de semicondutores asiáticos desabam; SK Hynix erra estimativas apesar de lucro recorde Policy xAI processa Minnesota sobre proibição de nudificação de IA; lei entra em vigor 1º de agosto Policy Juiz aprova acordo de direitos autorais de $1,5 bi da Anthropic; autores recebem ~$3.100 por obra
Breaking

LangChain Deep Agents v0.7: corte de tokens base de 65% via harness de prompt refinado; todos opt-in, override de middleware

LangChain lançou Deep Agents v0.7, refatorando seu harness de agente base para cortar tokens de entrada em 65% (6k → 2k tokens por turno) mantendo ou melhorando o desempenho das tarefas. Mudanças incluem: (1) remoção do prompt de sistema padrão e prosa de orientação de ferramenta geral, (2) refinamento de 43% de descrições de ferramentas integradas, (3) TodoListMiddleware agora opt-in em vez de padrão. A premissa espelha a descoberta recente da Anthropic de que o prompt de sistema do Claude Code foi reduzido > 80% para modelos Opus 5 / Fable 5 sem degradação de eval, validando a tese de que modelos de fronteira modernos estão sobre-construídos.

A validação foi executada em uma nova suite de eval abrangendo autônomo (coding, análise de dados), conversacional (interação com usuário de múltiplas volta), e long-context (recuperação + raciocínio) tarefas em quatro modelos: GPT-5.6-Luna, Gemini-3.6-Flash, Claude Sonnet 4.6, e Claude Opus 4.8. GPT-5.6-Luna mostrou redução de token de 34% e redução de custo de 15% com lift de recompensa de +4%. A maioria dos modelos se manteve firme em recompensa enquanto reduzia tokens/custo. Claude Sonnet 4.6 foi uma exceção (custo aumentado em duas tarefas autônomas desafiadoras), sinalizado em traços de LangSmith.

Para times de plataforma: esta é uma vitória de ops de produção. Reduzir tokens de harness base de 6k para 2k por turno significa inferência mais barata, latência mais baixa, e mais espaço para contexto em implantações restritas. A abordagem de middleware opt-in (TodoListMiddleware, override de SummarizationMiddleware) dá aos construtores controle fino sobre estratégia de prompt sem lutar contra o framework. O timing se alinha com um padrão mais amplo: à medida que a capacidade do modelo se estabiliza, eficiência de nível de harness torna-se a alavanca.

Fontes