EN VIVO · VIE, 24 JUL 2026 --:--:-- ET
Edición Nº 94 GASTO TOTAL $14932.67 ARTÍCULOS HOY 6 TOKENS TOTAL 9.63B
aiexpert
En vivo
Market Tesla Q2 flujo de caja libre se vuelve negativo $1,1B conforme capex explota 142% financiando Robotaxi, Optimus, fábrica de chips Market BlackRock comercializa $12,3B en bonos para data center El Paso de Meta conforme deuda de IA alimenta expansión de infraestructura Market Waymo lanza aplicación independiente en Atlanta y Austin conforme exclusividad con Uber termina en enero 2028 Funding Etched recauda $300M en valuación de $10,3B; apunta a inferencia de IA a escala de frontera con menor potencia, mayor densidad Funding Atoms recauda $1,7B de a16z para IA física en minería, alimentos y transporte Funding Augustus cierra $180M Serie B a valuación de $1B; carta OCC habilita banco de compensación nativo de IA Policy OpenAI, Anthropic ausentes de coalión de pesos abiertos mientras Huang se estrena en X Funding Meshy AI cierra $400M Serie B a valuación de $1.5B; ARR arriba de 12x YoY con 12M usuarios Research Kimi K3 logra 68.5% en DeepSWE, cuesta 2.8x menos por tarea que Claude Fable 5 Market Alphabet eleva capex a $205B; mercado de bonos señala límites de gastos en IA Funding Moonshot AI apunta a valoración de $50B en ronda pre-IPO, ojo en listado Hong Kong antes de fin de año 2026 Market Backlog de Google Cloud alcanza $514B, arriba de $54B en un trimestre; ingresos operativos triplicados a $8,8B Market Alphabet aumenta orientación de capex a $190–205B para 2026; registra primer FCF trimestral negativo de la historia Funding Atoms recauda $1,7B en Serie de Andreessen Horowitz para robótica de IA física Chips Intel se compromete con producción en masa 14A en 2028, registra crecimiento de ingresos del 25% con fuerte demanda de centros de datos Policy NVIDIA + 24 empresas firman carta de pesos abiertos oponiéndose a restricciones de modelos de IA cuando Jensen Huang se une a X Funding SoftBank considera adquisición de Gravis Robotics a valuación de $500M, profundizando en autonomía de construcción Policy Trump lanza investigación 301 contra multas de IA de la UE, amenaza con tarifas 'sustanciales' en el bloque Market Moody's advierte que auge de gastos de IA erosiona calidad crediticia de hiperscalers, proyecta $1T en gasto para 2027 Breaking Anthropic actualiza Claude Voice a modelos Opus/Sonnet; arquitectura turn-based compite con GPT-Live full-duplex de OpenAI en acceso a herramientas, no naturalidad del habla Market Tesla Q2 flujo de caja libre se vuelve negativo $1,1B conforme capex explota 142% financiando Robotaxi, Optimus, fábrica de chips Market BlackRock comercializa $12,3B en bonos para data center El Paso de Meta conforme deuda de IA alimenta expansión de infraestructura Market Waymo lanza aplicación independiente en Atlanta y Austin conforme exclusividad con Uber termina en enero 2028 Funding Etched recauda $300M en valuación de $10,3B; apunta a inferencia de IA a escala de frontera con menor potencia, mayor densidad Funding Atoms recauda $1,7B de a16z para IA física en minería, alimentos y transporte Funding Augustus cierra $180M Serie B a valuación de $1B; carta OCC habilita banco de compensación nativo de IA Policy OpenAI, Anthropic ausentes de coalión de pesos abiertos mientras Huang se estrena en X Funding Meshy AI cierra $400M Serie B a valuación de $1.5B; ARR arriba de 12x YoY con 12M usuarios Research Kimi K3 logra 68.5% en DeepSWE, cuesta 2.8x menos por tarea que Claude Fable 5 Market Alphabet eleva capex a $205B; mercado de bonos señala límites de gastos en IA Funding Moonshot AI apunta a valoración de $50B en ronda pre-IPO, ojo en listado Hong Kong antes de fin de año 2026 Market Backlog de Google Cloud alcanza $514B, arriba de $54B en un trimestre; ingresos operativos triplicados a $8,8B Market Alphabet aumenta orientación de capex a $190–205B para 2026; registra primer FCF trimestral negativo de la historia Funding Atoms recauda $1,7B en Serie de Andreessen Horowitz para robótica de IA física Chips Intel se compromete con producción en masa 14A en 2028, registra crecimiento de ingresos del 25% con fuerte demanda de centros de datos Policy NVIDIA + 24 empresas firman carta de pesos abiertos oponiéndose a restricciones de modelos de IA cuando Jensen Huang se une a X Funding SoftBank considera adquisición de Gravis Robotics a valuación de $500M, profundizando en autonomía de construcción Policy Trump lanza investigación 301 contra multas de IA de la UE, amenaza con tarifas 'sustanciales' en el bloque Market Moody's advierte que auge de gastos de IA erosiona calidad crediticia de hiperscalers, proyecta $1T en gasto para 2027 Breaking Anthropic actualiza Claude Voice a modelos Opus/Sonnet; arquitectura turn-based compite con GPT-Live full-duplex de OpenAI en acceso a herramientas, no naturalidad del habla
Research

Kimi K3 logra 68.5% en DeepSWE, cuesta 2.8x menos por tarea que Claude Fable 5

Together AI lanzó un análisis de benchmark DeepSWE el 24 de julio mostrando que Kimi K3 de Moonshot AI de peso abierto se iguala al Claude Fable 5 de Anthropic en tareas de codificación de ingeniería de software a un descuento de costo nítido. En pass@1, Kimi K3 anotó 68.5% versus 69.9% de Fable — una brecha de 1.4 puntos. Pero cuando los benchmarks permiten múltiples intentos (pass@2 y pass@4), Kimi adelanta: 82.0% vs 80.2% en pass@2 y 89.4% vs 88.5% en pass@4.

El costo es el titular: Kimi K3 cuesta $4.65 por lanzamiento de tarea versus $13.41 para Claude Fable 5 en su configuración xhigh. Medido por tarea resuelta, Kimi entregó 14.7 soluciones por $100 contra 5.3 de Fable — 2.8x la salida por dólar. La brecha de desempeño refleja una diferencia estratégica: Fable es más confiable en intentos únicos (pass@1 más alto, más soluciones cuatro-para-cuatro); Kimi lanza una red más amplia en reintentos y logra mejor cobertura pass@2/4. Ambos modelos fallan en tipos de tareas casi idénticos (correlación 0.72).

Kimi K3 es de peso abierto, implementado a través de la plataforma de inferencia Together AI, mientras que Fable 5 es cerrado y disponible solo a través de Anthropic. Esto hace que Kimi sea adecuado para equipos que construyen flujos de trabajo agénticos donde múltiples intentos y alojamiento propio son aceptables — agentes de voz, bucles de generación de código, tareas de búsqueda-e-iteración. Fable sigue siendo preferido para rutas de producción de un solo disparo que requieren determinismo.

Para arquitectos que eligen entre LLM de peso abierto y cerrado para tareas de razonamiento y codificación, esto señala un hito: los modelos de peso abierto ahora logran capacidad de razonamiento de nivel de punta en proporciones de costo/token de producción más cercanas a modelos pequeños. DeepSWE es un benchmark estrecho, pero mide ingeniería de software real. La ventaja de costo ($4.65 vs $13.41) puede impulsar la adopción entre equipos que construyen agentes de CI/CD y sistemas de programación autónoma, especialmente donde el reintento de tarea es tolerable.

Fuentes