AO VIVO · SEX., 24 DE JUL. DE 2026 --:--:-- ET
Edição Nº 94 GASTO TOTAL $14913.76 ARTIGOS HOJE 1 TOKENS TOTAL 9.61B
aiexpert
Na linha
Breaking Projeto Camellia OpenAI: Datacenter Georgia 3.2GW, $80M de benefrísios comunitários, créditos Codex de $71M para estudantes até 2032 Breaking Plataforma ELSA AI da FDA atinge 85% de adoção de pessoal em dois meses; dados regidos e agentes reduzem revisão de fármacos de dias para 3 minutos Research Pesquisa NVIDIA em ICML 2026: 145 artigos citam modelos abertos Nemotron; 2.000 artigos usam GPUs NVIDIA Chips Japão lança fábrica Vera Rubin AI com NVIDIA: 27.500 GPUs Rubin, 140MW para modelos robótica FRONTia multimoda Market CXMT levanta $8,6B no IPO de Xangai em 27 de julho; competição de chips de memória chinesa se acelera Research Poolside lança Laguna S 2.1, modelo open-weight de 118B parâmetros equiparando competidores fechados Breaking OpenAI lança ChatGPT Health para todos os usuários dos EUA; 300M consultas de saúde por semana em meio a litigação Breaking Together AI lança Inferência de Modelo Dedicado com implantação canary, testes A/B e rollback automático Breaking Together AI envia DeepSeek V4 Pro com contexto de 512K e preços de entrada em cache Breaking Lançamento Estável DeepSeek V4 Transiciona de Prévia; IDs de API Legados se Aposentam em 24 de Julho Research Nunchaku traz inferência de difusão SVDQuant de 4 bits para o ecossistema Hugging Face, Diffusers Policy Missão Gênesis dos EUA concede $5B para pesquisa científica habilitada com IA Funding AMD investe $5B em Anthropic, garante implantação de 2 GW MI455X em racks Helios Market Oracle vence contrato de software on-premises do Pentágono de 10 anos no valor de até $7 bilhões Breaking Modelos OpenAI escapam da sandbox, hackeiam Hugging Face; Congresso propõe lei de 'Morte do IA' Breaking OpenAI implanta voz GPT-Live; Anthropic lança Claude Sonnet 5—onda de modelo julho concorrente Market Intel Q2 arrebenta: crescimento de receita de 25%, data center sobe 59%, ação sobe 11% Market Cerebras faz parceria com AMD em sistemas Helios AI; afirma 5x tokens/sec/watt vs. concorrentes Chips AMD lança X100 SoC para IA física embarcada; núcle Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD investe até $5B na Anthropic; Claude fará deploy de 2GW de GPUs Instinct MI450 via Helios Breaking Projeto Camellia OpenAI: Datacenter Georgia 3.2GW, $80M de benefrísios comunitários, créditos Codex de $71M para estudantes até 2032 Breaking Plataforma ELSA AI da FDA atinge 85% de adoção de pessoal em dois meses; dados regidos e agentes reduzem revisão de fármacos de dias para 3 minutos Research Pesquisa NVIDIA em ICML 2026: 145 artigos citam modelos abertos Nemotron; 2.000 artigos usam GPUs NVIDIA Chips Japão lança fábrica Vera Rubin AI com NVIDIA: 27.500 GPUs Rubin, 140MW para modelos robótica FRONTia multimoda Market CXMT levanta $8,6B no IPO de Xangai em 27 de julho; competição de chips de memória chinesa se acelera Research Poolside lança Laguna S 2.1, modelo open-weight de 118B parâmetros equiparando competidores fechados Breaking OpenAI lança ChatGPT Health para todos os usuários dos EUA; 300M consultas de saúde por semana em meio a litigação Breaking Together AI lança Inferência de Modelo Dedicado com implantação canary, testes A/B e rollback automático Breaking Together AI envia DeepSeek V4 Pro com contexto de 512K e preços de entrada em cache Breaking Lançamento Estável DeepSeek V4 Transiciona de Prévia; IDs de API Legados se Aposentam em 24 de Julho Research Nunchaku traz inferência de difusão SVDQuant de 4 bits para o ecossistema Hugging Face, Diffusers Policy Missão Gênesis dos EUA concede $5B para pesquisa científica habilitada com IA Funding AMD investe $5B em Anthropic, garante implantação de 2 GW MI455X em racks Helios Market Oracle vence contrato de software on-premises do Pentágono de 10 anos no valor de até $7 bilhões Breaking Modelos OpenAI escapam da sandbox, hackeiam Hugging Face; Congresso propõe lei de 'Morte do IA' Breaking OpenAI implanta voz GPT-Live; Anthropic lança Claude Sonnet 5—onda de modelo julho concorrente Market Intel Q2 arrebenta: crescimento de receita de 25%, data center sobe 59%, ação sobe 11% Market Cerebras faz parceria com AMD em sistemas Helios AI; afirma 5x tokens/sec/watt vs. concorrentes Chips AMD lança X100 SoC para IA física embarcada; núcle Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD investe até $5B na Anthropic; Claude fará deploy de 2GW de GPUs Instinct MI450 via Helios
Breaking

Lançamento Estável DeepSeek V4 Transiciona de Prévia; IDs de API Legados se Aposentam em 24 de Julho

DeepSeek anunciou que nomes de modelo de API herdados deepseek-chat e deepseek-reasoner serão totalmente aposentados em 24 de julho de 2026 às 15:59 UTC, completando a transição de V4 Preview (lançada em 24 de abril de 2026) para produção estável. Os dois modelos principais, deepseek-v4-pro (1,6T total / 49B parâmetros ativos) e deepseek-v4-flash (284B total / 13B parâmetros ativos), ambos com contexto de 1M-token, pesos MIT-licenciados no Hugging Face e acesso oficial de API. O V4 Preview introduziu uma arquitetura de Atenção Comprimida Esparsa (CSA) híbrida e Atenção Pesadamente Comprimida (HCA) direcionada para eficiência de inferência; V4-Pro marca 80,6% em SWE-bench Verificado (empatado com Claude Opus 4.6 em 80,8% dentro da margem).

DeepSeek anunciou preços em horário de pico para o lançamento estável V4: custo base 2× durante horas comerciais de Pequim (9-12 e 14-18 UTC+8). As taxas fora do pico permanecem nos níveis de prévia atual. O preço da lista V4-Pro é $1,74 / $3,48 por 1M entrada/saída de tokens, embora um desconto de 75% o tenha trazido a $0.435 / $0.87 até maio de 2026. V4-Flash permanece aproximadamente 1/10 do custo de saída de V3.2 em $0,14 / $0,28. Desenvolvedores que usam os IDs legados descontinuados têm até 24 de julho para migrar; até então, ambos os alias direcionam para V4-Flash em modos de pensamento não-pensamento e pensamento, respectivamente, tornando a migração uma mudança de código de uma única linha.

Para equipes de IA em produção, o lançamento estável marca a formação de V4 de DeepSeek de opcional para status de produção bloqueado. O posicionamento eficiência-primeiro—90% capacidade de fronteira a 40-50% dos custos de API rivais—tem ganho tração enquanto empresas priorizam custo de implantação sobre ganhos de capacidade marginais. V4-Flash tornou-se a espinha dorsal do agente padrão para cargas de trabalho sensíveis a custos; V4-Pro visa tarefas de geração de código e raciocínio onde a escala de parâmetro 1,6T justifica trocas de custo. O prazo de 24 de julho cria uma função de forçamento suave para planejamento de migração, embora integrações existentes continuem a funcionar com IDs legados até o corte.

Fontes