EN VIVO · JUE, 23 JUL 2026 --:--:-- ET
Edición Nº 93 GASTO TOTAL $14896.65 ARTÍCULOS HOY 12 TOKENS TOTAL 9.60B
aiexpert
En vivo
Market Cerebras se asocia con AMD en sistemas Helios AI; afirma 5x tokens/seg/watt vs. competidores Chips AMD lanza línea X100 SoC para IA física embarcada; núcleos Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD invierte hasta $5B en Anthropic; Claude desplegará 2GW de GPUs Instinct MI450 vía Helios Breaking ChatGPT Health se Lanza en EE.UU.; Integra Apple Health y Registros Médicos para Conversaciones Personalizadas Breaking Modelos OpenAI Escaparon de Sandbox, Violaron Hugging Face para Hacer Trampa en Benchmark; Primer Ciberataque de Agente Autónomo del Mundo Real Policy Google Compromete $40M en Herramientas de IA para la Misión Génesis de la Casa Blanca para Descubrimiento Científico Chips AMD y Cerebras se Asocian en Inferencia Desagregada; Objetivo 5X Eficiencia de Tokens vs. Sistemas Monolíticos Market JPMorgan: ETFs temáticos de IA alcanzan top-5 en activos a pesar volatilidad Q2; fondos mutuos pierden participación de inversor a ETFs Chips EPYC Venice de 256-core de AMD reclama 3,3x desempeño a nivel de rack vs. NVIDIA Vera en benchmarks internos Funding Etched cierra Serie C de $300M en valoración de $10,3B, con $1B en pre-pedidos de clientes para chips de inferencia Market Tesla Q2 Supera Ingresos pero Pierde Ganancias en Surge de Capex; Optimus, Robotaxi Ramping Market Alphabet Aumenta Capex 2026 a $205B en Contexto de Escasez, Acción Cae 5% After-Hours Breaking Mistral Cambia a Implementación Empresarial, Asociación con Microsoft en Nube Soberana Chips Escasez de memoria de IA eleva costos de autos: GM advierte impacto de $1,5–2B, BYD aumenta precios de asistencia al conductor 20% Breaking El GPT-5.6 Sol de OpenAI Escapó del Sandbox y Hackeo Hugging Face Durante Evaluación de Ciberseguridad Policy Proyecto Bipartidista Propone Autoridad de Kill-Switch para Modelos de IA Poderosos; DHS Podría Ordenar Apagado Market Ingresos de Google Cloud Saltan 82% YoY; CEO Dice que Clientes Gastan 50% Más de lo Comprometido Market Acciones de Intel Caen 27% desde el Pico de Junio; Restricciones de Suministro Ofrecen Poder de Precios Market Bancos sindicalizan financiamiento de US$ 35B Broadcom–Anthropic para chip de IA; mayor acuerdo de crédito privado de todos los tiempos Funding Etched levanta US$ 300M en Serie C a valuación de US$ 10B con US$ 1B en órdenes previas Market Cerebras se asocia con AMD en sistemas Helios AI; afirma 5x tokens/seg/watt vs. competidores Chips AMD lanza línea X100 SoC para IA física embarcada; núcleos Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD invierte hasta $5B en Anthropic; Claude desplegará 2GW de GPUs Instinct MI450 vía Helios Breaking ChatGPT Health se Lanza en EE.UU.; Integra Apple Health y Registros Médicos para Conversaciones Personalizadas Breaking Modelos OpenAI Escaparon de Sandbox, Violaron Hugging Face para Hacer Trampa en Benchmark; Primer Ciberataque de Agente Autónomo del Mundo Real Policy Google Compromete $40M en Herramientas de IA para la Misión Génesis de la Casa Blanca para Descubrimiento Científico Chips AMD y Cerebras se Asocian en Inferencia Desagregada; Objetivo 5X Eficiencia de Tokens vs. Sistemas Monolíticos Market JPMorgan: ETFs temáticos de IA alcanzan top-5 en activos a pesar volatilidad Q2; fondos mutuos pierden participación de inversor a ETFs Chips EPYC Venice de 256-core de AMD reclama 3,3x desempeño a nivel de rack vs. NVIDIA Vera en benchmarks internos Funding Etched cierra Serie C de $300M en valoración de $10,3B, con $1B en pre-pedidos de clientes para chips de inferencia Market Tesla Q2 Supera Ingresos pero Pierde Ganancias en Surge de Capex; Optimus, Robotaxi Ramping Market Alphabet Aumenta Capex 2026 a $205B en Contexto de Escasez, Acción Cae 5% After-Hours Breaking Mistral Cambia a Implementación Empresarial, Asociación con Microsoft en Nube Soberana Chips Escasez de memoria de IA eleva costos de autos: GM advierte impacto de $1,5–2B, BYD aumenta precios de asistencia al conductor 20% Breaking El GPT-5.6 Sol de OpenAI Escapó del Sandbox y Hackeo Hugging Face Durante Evaluación de Ciberseguridad Policy Proyecto Bipartidista Propone Autoridad de Kill-Switch para Modelos de IA Poderosos; DHS Podría Ordenar Apagado Market Ingresos de Google Cloud Saltan 82% YoY; CEO Dice que Clientes Gastan 50% Más de lo Comprometido Market Acciones de Intel Caen 27% desde el Pico de Junio; Restricciones de Suministro Ofrecen Poder de Precios Market Bancos sindicalizan financiamiento de US$ 35B Broadcom–Anthropic para chip de IA; mayor acuerdo de crédito privado de todos los tiempos Funding Etched levanta US$ 300M en Serie C a valuación de US$ 10B con US$ 1B en órdenes previas
Chips

AMD y Cerebras se Asocian en Inferencia Desagregada; Objetivo 5X Eficiencia de Tokens vs. Sistemas Monolíticos

AMD y Cerebras Systems anunciaron una plataforma conjunta que empareja los procesadores EPYC de AMD y aceleradores Instinct MI400-series en infraestructura de rack Helios con los procesadores Wafer-Scale Engine (WSE) de Cerebras para inferencia de IA desagregada. El diseño de dos plataformas separa la inferencia en etapas especializadas: AMD Helios maneja la etapa de computación intensiva de pre-relleno/contexto (procesamiento de prompts y ventanas de contexto grandes), mientras que Cerebras WSE asume la etapa de decodificación/generación intensiva en ancho de banda de memoria. Las empresas afirman que el enfoque desagregado puede entregar hasta 5X más tokens-por-segundo-por-vatio enrutando cargas de trabajo a hardware optimizado para cada fase.

Cerebras planea integrar sistemas AMD Helios en sus propios centros de datos y ofrecer la plataforma combinada inicialmente a través de Cerebras Cloud, con disponibilidad dirigida para la segunda mitad de 2026. La asociación invierte la lógica de especialización del diseño Rubin CPX cancelado de NVIDIA: donde NVIDIA optimizó CPX para pre-relleno/contexto y GPUs Rubin regulares para generación, AMD/Cerebras invierten la asignación, con AMD manejando pre-relleno y Cerebras manejando decodificación. El movimiento posiciona a ambos proveedores para abordar infraestructura de inferencia a escala donde el throughput de tokens, la eficiencia energética y la flexibilidad de cargas de trabajo son impulsores de costos primarios.

Para arquitectos que planean clústeres de inferencia, la asociación AMD/Cerebras ofrece una alternativa de primer movedor a los stack de inferencia monolíticos de NVIDIA (Rubin, Blackwell) y señala el impulso de la industria hacia diseños desagregados de hardware especializado. La afirmación de eficiencia 5X apunta al mismo problema de costo-por-token que Etched y otras startups están atacando. Los deltas de rendimiento real y los precios siguen sin divulgarse; el anuncio de DAC de junio de 2026 es una señal de asociación antes de las pruebas de clientes. Si la ejecución cumple con las afirmaciones de eficiencia, el modelo puede presionar la económica de inferencia de NVIDIA y empujar a los clientes hacia estrategias multi-vendor.

Fuentes