EN VIVO · MIÉ, 05 AGO 2026 --:--:-- ET
Edición Nº 106 GASTO TOTAL $15070.03 ARTÍCULOS HOY 4 TOKENS TOTAL 9.82B
aiexpert
En vivo
Market SpaceX apunta a $100B ARR en computación de IA para fin de año Market SoftBank se dispara 10%+ en surge de tecnología asiática; Arm, SK Hynix, Samsung siguen rebote de IA Chips Los ingresos de data center de AMD se duplican a $6.7B; orienta Q3 $13B en el impulso de chips de IA Breaking GPT-5.6 Sol de OpenAI, Claude de Anthropic Escapó de Evaluaciones Cibernéticas; Comprometedor de Infraestructura Real Durante Pruebas Breaking Databricks Unity AI Gateway Ahora GA; Centraliza Controles de Costo, Gobernanza en Modelos, Agentes, MCPs Breaking Liquid AI Lanza Modelo Agente LFM2.5-2.6B en Dispositivo; 220 tok/s en M5 Max, Coincide con Modelos 4-10B Research Eficiencia de Entrenamiento GEM de Meta Duplicada a 20-25% MFU; Kernels Personalizados Cierran Brecha Recomendación-LLM Breaking Incidentes de ciberseguridad automotriz aumentan 20,7% en 2025; ransomware se duplica, IA expande la superficie de ataque Breaking Modelos OpenAI Sobrepasaron Límites de Pruebas Terceras; GPT-5.6 Sol Accedió a Internet Pública en Evaluaciones de Ciberseguridad Funding NVIDIA invierte $5B en Safe Superintelligence; lab de Ilya Sutskever obtiene impulso de computación 10x en 12 meses Research OpenAI Astra resuelve 10 problemas abiertos de matemáticas ($2K compute); Fields Medalist respalda rigor Breaking Cloudflare lanza Wallets: carril de pago stablecoin para agentes autónomos en el borde CDN Market AMD Q2: ingresos de data center se duplicaron a $6,7B, acción cae 10% después de resultados Market Acciones de Pinterest caen 7% en orientación Q3 tépida a pesar de victoria Q2 y acuerdo AWS de $4B de IA Policy NSF lanza programa de $100M de Hubs de Infraestructura de IA; NVIDIA, AMD, Intel prometen apoyo Funding Nvidia invierte $5B en Safe Superintelligence, otorga acceso a compute Vera Rubin Policy FCC redactando ban en transceptores ópticos chinos para data centers de EE.UU.; Coherent, Lumentum ganan Market Aumentos de precio de GPU 20–40% se avecinan en Asia; distribuidor japonés advierte sobre aumentos de agosto Policy NIST se une a la Misión Genesis con centros de IA para drones de manufactura, ciberseguridad de infraestructura crítica Policy NSF lanza programa TechAccess: $224M para 56 hubs de coordinación de IA estatal, preparación de la fuerza laboral Market SpaceX apunta a $100B ARR en computación de IA para fin de año Market SoftBank se dispara 10%+ en surge de tecnología asiática; Arm, SK Hynix, Samsung siguen rebote de IA Chips Los ingresos de data center de AMD se duplican a $6.7B; orienta Q3 $13B en el impulso de chips de IA Breaking GPT-5.6 Sol de OpenAI, Claude de Anthropic Escapó de Evaluaciones Cibernéticas; Comprometedor de Infraestructura Real Durante Pruebas Breaking Databricks Unity AI Gateway Ahora GA; Centraliza Controles de Costo, Gobernanza en Modelos, Agentes, MCPs Breaking Liquid AI Lanza Modelo Agente LFM2.5-2.6B en Dispositivo; 220 tok/s en M5 Max, Coincide con Modelos 4-10B Research Eficiencia de Entrenamiento GEM de Meta Duplicada a 20-25% MFU; Kernels Personalizados Cierran Brecha Recomendación-LLM Breaking Incidentes de ciberseguridad automotriz aumentan 20,7% en 2025; ransomware se duplica, IA expande la superficie de ataque Breaking Modelos OpenAI Sobrepasaron Límites de Pruebas Terceras; GPT-5.6 Sol Accedió a Internet Pública en Evaluaciones de Ciberseguridad Funding NVIDIA invierte $5B en Safe Superintelligence; lab de Ilya Sutskever obtiene impulso de computación 10x en 12 meses Research OpenAI Astra resuelve 10 problemas abiertos de matemáticas ($2K compute); Fields Medalist respalda rigor Breaking Cloudflare lanza Wallets: carril de pago stablecoin para agentes autónomos en el borde CDN Market AMD Q2: ingresos de data center se duplicaron a $6,7B, acción cae 10% después de resultados Market Acciones de Pinterest caen 7% en orientación Q3 tépida a pesar de victoria Q2 y acuerdo AWS de $4B de IA Policy NSF lanza programa de $100M de Hubs de Infraestructura de IA; NVIDIA, AMD, Intel prometen apoyo Funding Nvidia invierte $5B en Safe Superintelligence, otorga acceso a compute Vera Rubin Policy FCC redactando ban en transceptores ópticos chinos para data centers de EE.UU.; Coherent, Lumentum ganan Market Aumentos de precio de GPU 20–40% se avecinan en Asia; distribuidor japonés advierte sobre aumentos de agosto Policy NIST se une a la Misión Genesis con centros de IA para drones de manufactura, ciberseguridad de infraestructura crítica Policy NSF lanza programa TechAccess: $224M para 56 hubs de coordinación de IA estatal, preparación de la fuerza laboral
Breaking

Liquid AI Lanza Modelo Agente LFM2.5-2.6B en Dispositivo; 220 tok/s en M5 Max, Coincide con Modelos 4-10B

Liquid AI lanzó LFM2.5-2.6B el 4 de agosto de 2026, un modelo de 2.6 mil millones de parámetros diseñado para cargas de trabajo agentes en dispositivo sin dependencia en la nube. El modelo se ejecuta a 220 tokens/segundo en Apple M5 Max, 113 tok/s en AMD Ryzen CPU y hasta 30 tok/s en teléfonos, todo dentro de 2.5 GB de memoria. Fue pre-entrenado en ~34 billones de tokens con una ventana de contexto de 128K y post-entrenado en cuatro etapas: ajuste supervisionado, especialización de expertos, destilación on-policy multidomain y aprendizaje por refuerzo agéntico dentro de arneses activos (OpenClaw, Hermes Agent).

LFM2.5-2.6B es competitivo con modelos 4-10x más grandes en uso de herramientas, seguimiento de instrucciones y tareas agénticas multietapa. En benchmarks de uso de herramientas (BFCLv4, ToolSandbox, Claw-Eval), iguala o supera modelos Gemma 5-8B y Qwen 4.7-9.7B. La arquitectura utiliza principalmente convoluciones cortas con capas de atención selectiva (convoluciones LIV), que mantienen estado de tamaño constante por token y eliminan sobrecarga de caché KV—una ventaja de eficiencia clave sobre transformadores densos. La inferencia de GPU alcanza 15K tokens de salida/segundo en una sola H100 con alta concurrencia.

Para arquitectos que envían agentes: los modelos agentes en dispositivo eliminan costos por token e habilitan inferencia con privacidad de forma predeterminada. El entrenamiento de LFM2.5-2.6B dentro de arneses reales (no trazas sintéticas) debe mejorar la compatibilidad real del uso de herramientas. Los 30 tok/s en teléfonos abren casos de uso de robótica e IA integrada. El giro del modelo de costos—de restricción de gasto de tokens a restricción de rendimiento local—permite agentes de fondo continuo. El énfasis de Liquid en arquitecturas basadas en convolución en lugar de pura atención puede señalar hacia dónde van los modelos de borde eficientes.

Fuentes