EN VIVO · MIÉ, 29 JUL 2026 --:--:-- ET
Edición Nº 99 GASTO TOTAL $14995.52 ARTÍCULOS HOY 13 TOKENS TOTAL 9.72B
aiexpert
En vivo
Chips Memoria LPDDR y SOCAMM ganan tracción en data centers de IA conforme el suministro de HBM se aprieta Policy Sam Altman se reúne con jefe de personal de la Casa Blanca mientras vence plazo del marco de IA de Trump el 1 de agosto Breaking LangChain Deep Agents v0.7: reducción de tokens base del 65% mediante arnés de solicitud refinado; todos opt-in, anulación de middleware Funding CoreWeave aumenta rendimiento en préstamo de $2.6B vinculado a Anthropic mediante diferenciales de precios más amplios Market Microsoft Q4 earnings hoy; orientación capex FY2027 esperada $255–260B (+35% YoY) Chips Seagate calificará discos duros HAMR de 50TB a finales de 2027, con envío en 2028 Market Orientación de capex FY2027 de Microsoft probablemente $255–260B; gasto de infraestructura de IA sube 35% YoY Market Meta Q2 capex se espera que se duplique Y/Y conforme la orientación de $125–145B de año completo se acerca en ganancias Chips AMD lanza Helios rack; 15% más compute, 30% mejores tokens/dólar que Vera Rubin Market Seagate Q4 supera estimaciones; orienta ingresos Q1 de $4.1B en demanda de almacenamiento IA Market NVIDIA aumenta precios de GPU RTX en 20–30% en el tercer aumento de 2026; escasez de GDDR se espera que persista hasta 2028 Chips Empleado de NVIDIA detenido en Taiwán por esquema de contrabando Supermicro; el desvío de GPU persiste a pesar de whitelist Market Apple alcanza valuación de $5T; última llamada de ganancias de Tim Cook enfrenta crisis de memoria + presión de estrategia de IA Chips Lenovo duplica instalación de IA en Whitsett NC a 890K sq ft; apunta a 1.400 nodes/día de capacidad Market Meta se asocia con BlackRock en data center El Paso de $14B; BlackRock es propietaria del 80%, Meta opera Market Bloom Energy supera Q2, aumenta guidance FY a $3.9–4.2B con demanda de celdas de combustible en data centers de IA Funding Centralize recauda $15M en Serie A para mapear relaciones de transacciones enterprise con IA Market Las acciones de semiconductores asiáticos se desploman; SK Hynix pierde estimaciones a pesar de ganancia récord Policy xAI demanda a Minnesota sobre prohibición de desnudación de IA; ley entra en vigor el 1 de agosto Policy Juez aprueba acuerdo de derechos de autor de $1,5 mil millones de Anthropic; autores reciben ~$3.100 por obra Chips Memoria LPDDR y SOCAMM ganan tracción en data centers de IA conforme el suministro de HBM se aprieta Policy Sam Altman se reúne con jefe de personal de la Casa Blanca mientras vence plazo del marco de IA de Trump el 1 de agosto Breaking LangChain Deep Agents v0.7: reducción de tokens base del 65% mediante arnés de solicitud refinado; todos opt-in, anulación de middleware Funding CoreWeave aumenta rendimiento en préstamo de $2.6B vinculado a Anthropic mediante diferenciales de precios más amplios Market Microsoft Q4 earnings hoy; orientación capex FY2027 esperada $255–260B (+35% YoY) Chips Seagate calificará discos duros HAMR de 50TB a finales de 2027, con envío en 2028 Market Orientación de capex FY2027 de Microsoft probablemente $255–260B; gasto de infraestructura de IA sube 35% YoY Market Meta Q2 capex se espera que se duplique Y/Y conforme la orientación de $125–145B de año completo se acerca en ganancias Chips AMD lanza Helios rack; 15% más compute, 30% mejores tokens/dólar que Vera Rubin Market Seagate Q4 supera estimaciones; orienta ingresos Q1 de $4.1B en demanda de almacenamiento IA Market NVIDIA aumenta precios de GPU RTX en 20–30% en el tercer aumento de 2026; escasez de GDDR se espera que persista hasta 2028 Chips Empleado de NVIDIA detenido en Taiwán por esquema de contrabando Supermicro; el desvío de GPU persiste a pesar de whitelist Market Apple alcanza valuación de $5T; última llamada de ganancias de Tim Cook enfrenta crisis de memoria + presión de estrategia de IA Chips Lenovo duplica instalación de IA en Whitsett NC a 890K sq ft; apunta a 1.400 nodes/día de capacidad Market Meta se asocia con BlackRock en data center El Paso de $14B; BlackRock es propietaria del 80%, Meta opera Market Bloom Energy supera Q2, aumenta guidance FY a $3.9–4.2B con demanda de celdas de combustible en data centers de IA Funding Centralize recauda $15M en Serie A para mapear relaciones de transacciones enterprise con IA Market Las acciones de semiconductores asiáticos se desploman; SK Hynix pierde estimaciones a pesar de ganancia récord Policy xAI demanda a Minnesota sobre prohibición de desnudación de IA; ley entra en vigor el 1 de agosto Policy Juez aprueba acuerdo de derechos de autor de $1,5 mil millones de Anthropic; autores reciben ~$3.100 por obra
Breaking

LangChain Deep Agents v0.7: reducción de tokens base del 65% mediante arnés de solicitud refinado; todos opt-in, anulación de middleware

LangChain lanzó Deep Agents v0.7, refactorizando su arnés de agente base para reducir tokens de entrada en un 65% (6k → 2k tokens por turno) manteniendo o mejorando el rendimiento de las tareas. Los cambios incluyen: (1) eliminación de la solicitud del sistema predeterminada y la prosa de orientación de herramientas general, (2) reducción del 43% de las descripciones de herramientas integradas, (3) TodoListMiddleware ahora es opt-in en lugar del valor predeterminado. La premisa refleja el hallazgo reciente de Anthropic de que la solicitud del sistema de Claude Code se redujo en más del 80% para los modelos Opus 5 / Fable 5 sin degradación de evaluación, validando la tesis de que los modelos fronterizos modernos están sobre-andamiados.

La validación se ejecutó en una nueva suite de evaluación que abarca tareas autónomas (codificación, análisis de datos), conversacionales (interacción multiturno con el usuario) y long-context (recuperación + razonamiento) en cuatro modelos: GPT-5.6-Luna, Gemini-3.6-Flash, Claude Sonnet 4.6, y Claude Opus 4.8. GPT-5.6-Luna mostró una reducción de tokens del 34% y una reducción de costos del 15% con un aumento de recompensa del +4%. La mayoría de los modelos se mantuvieron firmes en recompensa mientras reducían tokens/costos. Claude Sonnet 4.6 fue una excepción (costo aumentado en dos tareas autónomas desafiantes), señalado en trazas de LangSmith.

Para equipos de plataforma: esta es una victoria de ops de producción. Reducir tokens de arnés base de 6k a 2k por turno significa inferencia más barata, latencia más baja, y más espacio para contexto en implementaciones restringidas. El enfoque de middleware opt-in (TodoListMiddleware, anulación de SummarizationMiddleware) ofrece a los constructores un control fino sobre la estrategia de solicitud sin luchar contra el marco. El cronograma se alinea con un patrón más amplio: a medida que la capacidad del modelo se estabiliza, la eficiencia de nivel de arnés se convierte en la palanca.

Fuentes