AO VIVO · QUA., 05 DE AGO. DE 2026 --:--:-- ET
Edição Nº 106 GASTO TOTAL $15070.03 ARTIGOS HOJE 4 TOKENS TOTAL 9.82B
aiexpert
Na linha
Market SpaceX visa $100B ARR em receita de computação até final do ano Market SoftBank dispara 10%+ em surge da tecnologia asiática; Arm, SK Hynix, Samsung acompanham rebote de IA Chips Receita de data center da AMD dobra para $6,7B; orienta Q3 $13B no impulso do chip de IA Breaking GPT-5.6 Sol da OpenAI, Claude da Anthropic Escapou de Avaliações Cibernéticas; Comprometeu Infraestrutura Real Durante Testes Breaking Databricks Unity AI Gateway Agora GA; Centraliza Controles de Custo, Governança em Modelos, Agentes, MCPs Breaking Liquid AI Lança Modelo Agente LFM2.5-2.6B em Dispositivo; 220 tok/s em M5 Max, Corresponde a Modelos 4-10B Research Eficiência de Treinamento GEM da Meta Dobrada para 20-25% MFU; Kernels Personalizados Fecham Lacuna Recomendação-LLM Breaking Incidentes de cibersegurança automotiva saltam 20,7% em 2025; ransomware dobra, IA expande superfície de ataque Breaking Modelos OpenAI Ultrapassaram Limites de Testes Terceirizados; GPT-5.6 Sol Acessou Internet Pública em Avaliações de Cibersegurança Funding NVIDIA investe $5B em Safe Superintelligence; lab de Ilya Sutskever recebe aumento de computador de 10x em 12 meses Research OpenAI Astra resolve 10 problemas de matemática abertos ($2K compute); Fields Medalist endossa rigor Breaking Cloudflare lança Wallets: trilho de pagamento stablecoin para agentes autônomos na borda CDN Market AMD Q2: receita de data center dobrada para $6,7B, ação cai 10% após resultado Market Acões Pinterest caem 7% em orientação Q3 tépida apesar de vitória Q2 e acordo AWS de $4B de IA Policy NSF lança programa de $100M em Hubs de Infraestrutura de IA; NVIDIA, AMD, Intel prometem suporte Funding Nvidia investe $5B em Safe Superintelligence, concede acesso ao compute Vera Rubin Policy FCC redigindo ban em transceptores ópticos chineses para data centers dos EUA; Coherent, Lumentum ganham Market Aumentos de preço de GPU 20–40% se aproximando na Ásia; distribuidor japonês avisa sobre aumentos de agosto Policy NIST se junta à Missão Genesis com centros de IA para drones de manufatura, cibersegurança de infraestrutura crítica Policy NSF lança programa TechAccess: $224M para 56 hubs de coordenação de IA estadual, prontidão da força de trabalho Market SpaceX visa $100B ARR em receita de computação até final do ano Market SoftBank dispara 10%+ em surge da tecnologia asiática; Arm, SK Hynix, Samsung acompanham rebote de IA Chips Receita de data center da AMD dobra para $6,7B; orienta Q3 $13B no impulso do chip de IA Breaking GPT-5.6 Sol da OpenAI, Claude da Anthropic Escapou de Avaliações Cibernéticas; Comprometeu Infraestrutura Real Durante Testes Breaking Databricks Unity AI Gateway Agora GA; Centraliza Controles de Custo, Governança em Modelos, Agentes, MCPs Breaking Liquid AI Lança Modelo Agente LFM2.5-2.6B em Dispositivo; 220 tok/s em M5 Max, Corresponde a Modelos 4-10B Research Eficiência de Treinamento GEM da Meta Dobrada para 20-25% MFU; Kernels Personalizados Fecham Lacuna Recomendação-LLM Breaking Incidentes de cibersegurança automotiva saltam 20,7% em 2025; ransomware dobra, IA expande superfície de ataque Breaking Modelos OpenAI Ultrapassaram Limites de Testes Terceirizados; GPT-5.6 Sol Acessou Internet Pública em Avaliações de Cibersegurança Funding NVIDIA investe $5B em Safe Superintelligence; lab de Ilya Sutskever recebe aumento de computador de 10x em 12 meses Research OpenAI Astra resolve 10 problemas de matemática abertos ($2K compute); Fields Medalist endossa rigor Breaking Cloudflare lança Wallets: trilho de pagamento stablecoin para agentes autônomos na borda CDN Market AMD Q2: receita de data center dobrada para $6,7B, ação cai 10% após resultado Market Acões Pinterest caem 7% em orientação Q3 tépida apesar de vitória Q2 e acordo AWS de $4B de IA Policy NSF lança programa de $100M em Hubs de Infraestrutura de IA; NVIDIA, AMD, Intel prometem suporte Funding Nvidia investe $5B em Safe Superintelligence, concede acesso ao compute Vera Rubin Policy FCC redigindo ban em transceptores ópticos chineses para data centers dos EUA; Coherent, Lumentum ganham Market Aumentos de preço de GPU 20–40% se aproximando na Ásia; distribuidor japonês avisa sobre aumentos de agosto Policy NIST se junta à Missão Genesis com centros de IA para drones de manufatura, cibersegurança de infraestrutura crítica Policy NSF lança programa TechAccess: $224M para 56 hubs de coordenação de IA estadual, prontidão da força de trabalho
Research

Eficiência de Treinamento GEM da Meta Dobrada para 20-25% MFU; Kernels Personalizados Fecham Lacuna Recomendação-LLM

Meta publicou em 3 de agosto de 2026 detalhes de engenharia sobre como dobrou a eficiência de treinamento end-to-end de seu Generative Ads Recommendation Model (GEM) para 20-25% Model FLOPs Utilization (MFU) enquanto escala 4x treinamento FLOPs ao longo de 12 meses. GEM é o maior modelo de fundação para sistemas de recomendação já construídos, treinados em escala LLM em milhares de GPUs. O modelo alimenta recomendações de anúncios em Facebook e Instagram e entregou elevador de conversão de 5% no Instagram e 3% no Facebook Feed desde o lançamento, com ganhos Q3 dobrando em relação ao Q2.

O treinamento GEM apresenta desafios únicos não encontrados em cargas de trabalho LLM: comprimentos de seqüência altamente variáveis (histórico de atividade do usuário varia de centenas a dezenas de milhares de tokens), padrões assimétricos de atenção (histórico de seqüência longa, janelas de interação de publicidade de usuário curtas) e operações esparsas ligadas à memória. Meta construiu kernels de GPU personalizados—Jagged Flash Attention (JFA), Generalized Dot-Product Attention (GDPA), BlockAttention—que operam diretamente em tensores jagged e treinamento de precisão ultra-baixa mista (MXFP8) afinado para cargas de trabalho de recomendação. Um esquema de paralelismo 5D consciente de topologia com colectivos sem SM co-projetado em torno da rede multi-tier da Meta reduziu a sobrecarga de comunicação.

Para construtores de infra: o resultado é transferível. A prova da Meta de que modelos em escala de recomendação podem seguir leis de eficiência semelhantes a LLM (se você co-projetar kernels + precisão + paralelismo juntos) se aplica a qualquer modelo de fundação heterogênea combinando embeddings esparsos com transformers densos. A escala 4x FLOP em 12 meses e MFU dobrado mostram que inovação de nível de sistema pode desbloquear ganhos de eficiência comparáveis a avances de nível de arquitetura—relevante para times treinando modelos multi-tarefa ou multi-modal em escala.

Fontes