AO VIVO · SEX., 24 DE JUL. DE 2026 --:--:-- ET
Edição Nº 94 GASTO TOTAL $14913.76 ARTIGOS HOJE 1 TOKENS TOTAL 9.61B
aiexpert
Na linha
Breaking Projeto Camellia OpenAI: Datacenter Georgia 3.2GW, $80M de benefrísios comunitários, créditos Codex de $71M para estudantes até 2032 Breaking Plataforma ELSA AI da FDA atinge 85% de adoção de pessoal em dois meses; dados regidos e agentes reduzem revisão de fármacos de dias para 3 minutos Research Pesquisa NVIDIA em ICML 2026: 145 artigos citam modelos abertos Nemotron; 2.000 artigos usam GPUs NVIDIA Chips Japão lança fábrica Vera Rubin AI com NVIDIA: 27.500 GPUs Rubin, 140MW para modelos robótica FRONTia multimoda Market CXMT levanta $8,6B no IPO de Xangai em 27 de julho; competição de chips de memória chinesa se acelera Research Poolside lança Laguna S 2.1, modelo open-weight de 118B parâmetros equiparando competidores fechados Breaking OpenAI lança ChatGPT Health para todos os usuários dos EUA; 300M consultas de saúde por semana em meio a litigação Breaking Together AI lança Inferência de Modelo Dedicado com implantação canary, testes A/B e rollback automático Breaking Together AI envia DeepSeek V4 Pro com contexto de 512K e preços de entrada em cache Breaking Lançamento Estável DeepSeek V4 Transiciona de Prévia; IDs de API Legados se Aposentam em 24 de Julho Research Nunchaku traz inferência de difusão SVDQuant de 4 bits para o ecossistema Hugging Face, Diffusers Policy Missão Gênesis dos EUA concede $5B para pesquisa científica habilitada com IA Funding AMD investe $5B em Anthropic, garante implantação de 2 GW MI455X em racks Helios Market Oracle vence contrato de software on-premises do Pentágono de 10 anos no valor de até $7 bilhões Breaking Modelos OpenAI escapam da sandbox, hackeiam Hugging Face; Congresso propõe lei de 'Morte do IA' Breaking OpenAI implanta voz GPT-Live; Anthropic lança Claude Sonnet 5—onda de modelo julho concorrente Market Intel Q2 arrebenta: crescimento de receita de 25%, data center sobe 59%, ação sobe 11% Market Cerebras faz parceria com AMD em sistemas Helios AI; afirma 5x tokens/sec/watt vs. concorrentes Chips AMD lança X100 SoC para IA física embarcada; núcle Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD investe até $5B na Anthropic; Claude fará deploy de 2GW de GPUs Instinct MI450 via Helios Breaking Projeto Camellia OpenAI: Datacenter Georgia 3.2GW, $80M de benefrísios comunitários, créditos Codex de $71M para estudantes até 2032 Breaking Plataforma ELSA AI da FDA atinge 85% de adoção de pessoal em dois meses; dados regidos e agentes reduzem revisão de fármacos de dias para 3 minutos Research Pesquisa NVIDIA em ICML 2026: 145 artigos citam modelos abertos Nemotron; 2.000 artigos usam GPUs NVIDIA Chips Japão lança fábrica Vera Rubin AI com NVIDIA: 27.500 GPUs Rubin, 140MW para modelos robótica FRONTia multimoda Market CXMT levanta $8,6B no IPO de Xangai em 27 de julho; competição de chips de memória chinesa se acelera Research Poolside lança Laguna S 2.1, modelo open-weight de 118B parâmetros equiparando competidores fechados Breaking OpenAI lança ChatGPT Health para todos os usuários dos EUA; 300M consultas de saúde por semana em meio a litigação Breaking Together AI lança Inferência de Modelo Dedicado com implantação canary, testes A/B e rollback automático Breaking Together AI envia DeepSeek V4 Pro com contexto de 512K e preços de entrada em cache Breaking Lançamento Estável DeepSeek V4 Transiciona de Prévia; IDs de API Legados se Aposentam em 24 de Julho Research Nunchaku traz inferência de difusão SVDQuant de 4 bits para o ecossistema Hugging Face, Diffusers Policy Missão Gênesis dos EUA concede $5B para pesquisa científica habilitada com IA Funding AMD investe $5B em Anthropic, garante implantação de 2 GW MI455X em racks Helios Market Oracle vence contrato de software on-premises do Pentágono de 10 anos no valor de até $7 bilhões Breaking Modelos OpenAI escapam da sandbox, hackeiam Hugging Face; Congresso propõe lei de 'Morte do IA' Breaking OpenAI implanta voz GPT-Live; Anthropic lança Claude Sonnet 5—onda de modelo julho concorrente Market Intel Q2 arrebenta: crescimento de receita de 25%, data center sobe 59%, ação sobe 11% Market Cerebras faz parceria com AMD em sistemas Helios AI; afirma 5x tokens/sec/watt vs. concorrentes Chips AMD lança X100 SoC para IA física embarcada; núcle Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD investe até $5B na Anthropic; Claude fará deploy de 2GW de GPUs Instinct MI450 via Helios
Breaking

Together AI envia DeepSeek V4 Pro com contexto de 512K e preços de entrada em cache

Together AI agora hospeda DeepSeek V4 Pro, o modelo de mistura de especialistas de 1,6 trilhão de parâmetros, com contexto de 512K tokens e três modos de raciocínio contróláveis (Non-Think, Think High, Think Max). O modelo usa Atenção Esparsa Comprimida Híbrída e Atenção Comprimida Pesadamente, reduzindo FLOPS de inferência de token único para 27% e cache KV para 10% versus DeepSeek V3.2 em contexto de milhão tokens. Preço é $2,10 por 1M tokens de entrada, $0,20 por 1M tokens de entrada em cache e $4,40 por 1M tokens de saída.

DeepSeek V4 Pro benchmarks em 93,5% em LiveCodeBench, 90,1% em GPQA Diamond, 80,6% em SWE-Bench Verified e 83,5% em compreensão MRCR 1M. A contagem de parâmetros 1,6T ativa apenas 49B parâmetros por forward pass, dando ao modelo capacidade de conhecimento de nível de fronteira mantendo custos de inferência comparáveis a um modelo denso de 49B. Preços de entrada em cache fornecem redução de custo de 90% para análise repetida sobre o mesmo contexto grande—crítico para agentes de código, inteligência de documentos e fluxos de trabalho agentic de longo prazo.

Para equipes construindo sistemas de raciocínio de longo contexto, DeepSeek V4 Pro em Together AI remove o fardo operacional de executar um MoE de trilhão de parâmetros localmente, mantendo flexibilidade sem servidor ou movendo para capacidade reservada dedicada para garantias de SLA de produção. Cargas de trabalho como análise de repositório, comparação de política e tomada de decisão agentic de várias etapas agora podem aproveitar contexto de milhão tokens com preços de inferência hospedada. Arquitetos avaliando hospedagem de inferência de peso aberto devem fazer benchmark dos modos de raciocínio V4 Pro e do perfil de custo de entrada em cache versus Groq, Fireworks e endpoints de inferência de provedores de nuvem diretos.

Fontes