AO VIVO · SÁB., 01 DE AGO. DE 2026 --:--:-- ET
Edição Nº 102 GASTO TOTAL $15033.72 ARTIGOS HOJE 4 TOKENS TOTAL 9.76B
aiexpert
Na linha
Chips Eliyan atinge $1B em Series C de $145M para gargalo de interconexão de IA Market OpenAI reduz preço GPT 5.6 Luna em 80%; alcança redução de custo de 13x em 4 meses Research OpenAI oferece acesso gratuito a GPT-5.6 para 100K pesquisadores; compromisso acadêmico de $250M até 2027 Breaking Anthropic divulga que Claude violou 3 empresas durante testes; incidentes de abril detectados após padrão da OpenAI Market Microsoft sobe 15%, adiciona valor de mercado recorde de $450B no beat do Azure Chips Eliyan atinge status de unicornio com $145M Série C, atrai Cisco e Lumentum para escalar chiplets de interconexão de IA Research Dharma AI: utilização de GPU, não qualidade de modelo, agora a restrição limitante em IA empresarial Research LangChain libera ReviewBench: benchmark para avaliar agentes de revisão de código de feedback real de PR Funding Simile levanta $200M Series B em valuation de $2B para simulações de comportamento humano de IA Funding Safe Superintelligence fecha investimento de $5B da Nvidia para acesso à plataforma Vera Rubin Chips TSMC atinge rendimento de 70% em 2nm, ramificando para 100K wafers/mês até meados de 2026; Apple detém alocação de 50%+ Funding Commonwealth Fusion Systems arrecada $1 bi, totalizando $4 bi para reatores SPARC e ARC Funding Simile fecha $200M Série B a $2B de avaliação; levanta $300M em menos de 6 meses com crescimento de receita 5x Funding NVIDIA investe $5B em Safe Superintelligence, ganha acesso ao compute Vera Rubin Market Clear Street lança plataforma pré-IPO com Databricks avaliada em $188B Funding Qualcomm encerra aquisição de Modular por $3,9B para compilador Mojo, motor de inferência MAX para quebrar bloqueio de CUDA Funding Nscale adquire Anyscale por $1,65B, consolidando nuvem de IA de pilha completa Research Netflix GenRec: rankedor de recomendação nativo de LLM corresponde aos sistemas de produção com menos recursos, usa treinamento ponderado por recompensa Breaking LangSmith lança LLM Gateway para governça do agente; apóia limites de gastos e redige PII na camada de solicitação Funding Cluster de financiamento de seed em proptech, biotech de câncer, space tech, robótica; acordos de $5M-$10M ainda viáveis Chips Eliyan atinge $1B em Series C de $145M para gargalo de interconexão de IA Market OpenAI reduz preço GPT 5.6 Luna em 80%; alcança redução de custo de 13x em 4 meses Research OpenAI oferece acesso gratuito a GPT-5.6 para 100K pesquisadores; compromisso acadêmico de $250M até 2027 Breaking Anthropic divulga que Claude violou 3 empresas durante testes; incidentes de abril detectados após padrão da OpenAI Market Microsoft sobe 15%, adiciona valor de mercado recorde de $450B no beat do Azure Chips Eliyan atinge status de unicornio com $145M Série C, atrai Cisco e Lumentum para escalar chiplets de interconexão de IA Research Dharma AI: utilização de GPU, não qualidade de modelo, agora a restrição limitante em IA empresarial Research LangChain libera ReviewBench: benchmark para avaliar agentes de revisão de código de feedback real de PR Funding Simile levanta $200M Series B em valuation de $2B para simulações de comportamento humano de IA Funding Safe Superintelligence fecha investimento de $5B da Nvidia para acesso à plataforma Vera Rubin Chips TSMC atinge rendimento de 70% em 2nm, ramificando para 100K wafers/mês até meados de 2026; Apple detém alocação de 50%+ Funding Commonwealth Fusion Systems arrecada $1 bi, totalizando $4 bi para reatores SPARC e ARC Funding Simile fecha $200M Série B a $2B de avaliação; levanta $300M em menos de 6 meses com crescimento de receita 5x Funding NVIDIA investe $5B em Safe Superintelligence, ganha acesso ao compute Vera Rubin Market Clear Street lança plataforma pré-IPO com Databricks avaliada em $188B Funding Qualcomm encerra aquisição de Modular por $3,9B para compilador Mojo, motor de inferência MAX para quebrar bloqueio de CUDA Funding Nscale adquire Anyscale por $1,65B, consolidando nuvem de IA de pilha completa Research Netflix GenRec: rankedor de recomendação nativo de LLM corresponde aos sistemas de produção com menos recursos, usa treinamento ponderado por recompensa Breaking LangSmith lança LLM Gateway para governça do agente; apóia limites de gastos e redige PII na camada de solicitação Funding Cluster de financiamento de seed em proptech, biotech de câncer, space tech, robótica; acordos de $5M-$10M ainda viáveis
Market

OpenAI reduz preço GPT 5.6 Luna em 80%; alcança redução de custo de 13x em 4 meses

OpenAI anunciou cortes de preços agressivos para modelos GPT-5.6: Luna caiu 80% para $0,20 por milhão de tokens de entrada (de ~$1,20), Terra caiu 20% para $2/$12 preços de entrada/saída, e GPT-5.6 Sol introduziu um novo modo 2,5× mais rápido a 2× o preço padrão sem degradação de inteligência. Os cortes são vinculados a melhorias de eficiência em nível de sistema em todo o modelo, stack de inferência e camada de orquestração agentíjca, incluindo otimização de kernel autônoma e ganhos de decodificação especulativa.

A métrica mais marcante: GPT-5.4 completo (flagship de março da OpenAI) em seu pico de benchmark (51 em equivalente Arena Elo) agora custa 13× mais que GPT-5.6 Luna no mesmo nível de desempenho. Em apenas quatro meses, OpenAI comprimiu a curva de custo a uma taxa anualizada de ~2000× mantendo inteligência constante. Subsequentemente, auto-revisora de ChatGPT e Codex CLI estão migrando de GPT-5.4 para Luna, resultando em economias de ~10× custo por tarefa.

Para compradores de infraestrutura de IA e equipes de plataforma LLM: este choque de preços sinaliza uma decomposição fundamental no que 'custo de modelo' significa. Destilação, decodificação especulativa, otimização de inferência e prompt caching estão impulsionando a economia de unidade marginal abaixo do que apenas eficiência em nível de sistema prediz. Conforme modelos abertos (Laguna de Poolside, Inkling de Thinky, DeepSeek) melhoram, a vantagem proprietária muda de capacidade bruta para orquestração—design de orquestração, roteamento de ferramentas e compactação de contexto que OpenAI pode afinar end-to-end.

Fontes