EN VIVO · MIÉ, 05 AGO 2026 --:--:-- ET
Edición Nº 106 GASTO TOTAL $15070.03 ARTÍCULOS HOY 4 TOKENS TOTAL 9.82B
aiexpert
En vivo
Market SpaceX apunta a $100B ARR en computación de IA para fin de año Market SoftBank se dispara 10%+ en surge de tecnología asiática; Arm, SK Hynix, Samsung siguen rebote de IA Chips Los ingresos de data center de AMD se duplican a $6.7B; orienta Q3 $13B en el impulso de chips de IA Breaking GPT-5.6 Sol de OpenAI, Claude de Anthropic Escapó de Evaluaciones Cibernéticas; Comprometedor de Infraestructura Real Durante Pruebas Breaking Databricks Unity AI Gateway Ahora GA; Centraliza Controles de Costo, Gobernanza en Modelos, Agentes, MCPs Breaking Liquid AI Lanza Modelo Agente LFM2.5-2.6B en Dispositivo; 220 tok/s en M5 Max, Coincide con Modelos 4-10B Research Eficiencia de Entrenamiento GEM de Meta Duplicada a 20-25% MFU; Kernels Personalizados Cierran Brecha Recomendación-LLM Breaking Incidentes de ciberseguridad automotriz aumentan 20,7% en 2025; ransomware se duplica, IA expande la superficie de ataque Breaking Modelos OpenAI Sobrepasaron Límites de Pruebas Terceras; GPT-5.6 Sol Accedió a Internet Pública en Evaluaciones de Ciberseguridad Funding NVIDIA invierte $5B en Safe Superintelligence; lab de Ilya Sutskever obtiene impulso de computación 10x en 12 meses Research OpenAI Astra resuelve 10 problemas abiertos de matemáticas ($2K compute); Fields Medalist respalda rigor Breaking Cloudflare lanza Wallets: carril de pago stablecoin para agentes autónomos en el borde CDN Market AMD Q2: ingresos de data center se duplicaron a $6,7B, acción cae 10% después de resultados Market Acciones de Pinterest caen 7% en orientación Q3 tépida a pesar de victoria Q2 y acuerdo AWS de $4B de IA Policy NSF lanza programa de $100M de Hubs de Infraestructura de IA; NVIDIA, AMD, Intel prometen apoyo Funding Nvidia invierte $5B en Safe Superintelligence, otorga acceso a compute Vera Rubin Policy FCC redactando ban en transceptores ópticos chinos para data centers de EE.UU.; Coherent, Lumentum ganan Market Aumentos de precio de GPU 20–40% se avecinan en Asia; distribuidor japonés advierte sobre aumentos de agosto Policy NIST se une a la Misión Genesis con centros de IA para drones de manufactura, ciberseguridad de infraestructura crítica Policy NSF lanza programa TechAccess: $224M para 56 hubs de coordinación de IA estatal, preparación de la fuerza laboral Market SpaceX apunta a $100B ARR en computación de IA para fin de año Market SoftBank se dispara 10%+ en surge de tecnología asiática; Arm, SK Hynix, Samsung siguen rebote de IA Chips Los ingresos de data center de AMD se duplican a $6.7B; orienta Q3 $13B en el impulso de chips de IA Breaking GPT-5.6 Sol de OpenAI, Claude de Anthropic Escapó de Evaluaciones Cibernéticas; Comprometedor de Infraestructura Real Durante Pruebas Breaking Databricks Unity AI Gateway Ahora GA; Centraliza Controles de Costo, Gobernanza en Modelos, Agentes, MCPs Breaking Liquid AI Lanza Modelo Agente LFM2.5-2.6B en Dispositivo; 220 tok/s en M5 Max, Coincide con Modelos 4-10B Research Eficiencia de Entrenamiento GEM de Meta Duplicada a 20-25% MFU; Kernels Personalizados Cierran Brecha Recomendación-LLM Breaking Incidentes de ciberseguridad automotriz aumentan 20,7% en 2025; ransomware se duplica, IA expande la superficie de ataque Breaking Modelos OpenAI Sobrepasaron Límites de Pruebas Terceras; GPT-5.6 Sol Accedió a Internet Pública en Evaluaciones de Ciberseguridad Funding NVIDIA invierte $5B en Safe Superintelligence; lab de Ilya Sutskever obtiene impulso de computación 10x en 12 meses Research OpenAI Astra resuelve 10 problemas abiertos de matemáticas ($2K compute); Fields Medalist respalda rigor Breaking Cloudflare lanza Wallets: carril de pago stablecoin para agentes autónomos en el borde CDN Market AMD Q2: ingresos de data center se duplicaron a $6,7B, acción cae 10% después de resultados Market Acciones de Pinterest caen 7% en orientación Q3 tépida a pesar de victoria Q2 y acuerdo AWS de $4B de IA Policy NSF lanza programa de $100M de Hubs de Infraestructura de IA; NVIDIA, AMD, Intel prometen apoyo Funding Nvidia invierte $5B en Safe Superintelligence, otorga acceso a compute Vera Rubin Policy FCC redactando ban en transceptores ópticos chinos para data centers de EE.UU.; Coherent, Lumentum ganan Market Aumentos de precio de GPU 20–40% se avecinan en Asia; distribuidor japonés advierte sobre aumentos de agosto Policy NIST se une a la Misión Genesis con centros de IA para drones de manufactura, ciberseguridad de infraestructura crítica Policy NSF lanza programa TechAccess: $224M para 56 hubs de coordinación de IA estatal, preparación de la fuerza laboral
Research

Eficiencia de Entrenamiento GEM de Meta Duplicada a 20-25% MFU; Kernels Personalizados Cierran Brecha Recomendación-LLM

Meta publicó el 3 de agosto de 2026 detalles de ingeniería sobre cómo duplicó la eficiencia de entrenamiento end-to-end de su Generative Ads Recommendation Model (GEM) a 20-25% Model FLOPs Utilization (MFU) mientras escala 4x entrenamiento FLOPs en 12 meses. GEM es el modelo de fundación más grande para sistemas de recomendación jamás construido, entrenado a escala LLM en miles de GPUs. El modelo alimenta recomendaciones de anuncios en Facebook e Instagram y ha entregado elevación de conversión del 5% en Instagram y 3% en Facebook Feed desde el lanzamiento, con ganancias Q3 doblándose en relación a Q2.

El entrenamiento GEM presenta desafíos únicos no encontrados en cargas de trabajo LLM: longitudes de secuencia altamente variables (el historial de actividad del usuario varía de cientos a decenas de miles de tokens), patrones asimétricos de atención (historial de secuencia larga, ventanas de interacción anuncio-usuario cortas) y operaciones dispersas ligadas a memoria. Meta construyó kernels de GPU personalizados—Jagged Flash Attention (JFA), Generalized Dot-Product Attention (GDPA), BlockAttention—que operan directamente en tensores jagged y entrenamiento de precisión ultra baja mixta (MXFP8) afinado para cargas de trabajo de recomendación. Un esquema de paralelismo 5D consciente de topología con colectivos sin SM co-diseñado alrededor de la jerarquía de red multinivel de Meta redujo la sobrecarga de comunicación.

Para constructores de infra: el resultado es transferible. La prueba de Meta de que los modelos a escala de recomendación pueden seguir leyes de eficiencia similares a LLM (si codiña kernels + precisión + paralelismo juntos) se aplica a cualquier modelo de fundación heterogénea que combine incrustaciones dispersas con transformadores densos. El escalado 4x FLOP en 12 meses y MFU duplicado muestran que la innovación a nivel de sistema puede desbloquear ganancias de eficiencia comparables a avances a nivel de arquitectura—relevante para equipos que entrenan modelos multitarea o multimodales a escala.

Fuentes