EN VIVO · VIE, 24 JUL 2026 --:--:-- ET
Edición Nº 94 GASTO TOTAL $14913.76 ARTÍCULOS HOY 1 TOKENS TOTAL 9.61B
aiexpert
En vivo
Breaking Proyecto Camellia de OpenAI: Centro de datos Georgia 3.2GW, beneficios comunitarios $80M, créditos Codex $71M para estudiantes hasta 2032 Breaking La plataforma ELSA AI de la FDA alcanza 85% de adopción del personal en dos meses; datos gobernados y agentes reducen revisión de fármacos de días a 3 minutos Research Investigación NVIDIA en ICML 2026: 145 artículos citan modelos abiertos Nemotron; 2.000 artículos usan GPUs NVIDIA Chips Japón lanza fábrica Vera Rubin AI con NVIDIA: 27.500 GPUs Rubin, 140MW para modelos robótica FRONTia multimoda Market CXMT recauda $8,6B en IPO de Shanghai el 27 de julio; competencia de chips de memoria china se acelera Research Poolside lanza Laguna S 2.1, modelo open-weight de 118B parámetros igualando competidores cerrados Breaking OpenAI lanza ChatGPT Health para todos los usuarios de EE.UU.; 300M consultas de salud por semana en medio de litigio Breaking Together AI lanza Inferencia de Modelo Dedicado con despliegue canario, pruebas A/B y reversión automática Breaking Together AI envía DeepSeek V4 Pro con contexto de 512K y precios de entrada en caché Breaking Lanzamiento Estable DeepSeek V4 Transiciona de Vista Previa; IDs de API Heredados se Retiran el 24 de Julio Research Nunchaku trae inferencia de difusión SVDQuant de 4 bits al ecosistema Hugging Face, Diffusers Policy Misión Génesis de EE.UU. otorga $5B para investigación científica habilitada con IA Funding AMD invierte $5B en Anthropic, asegura implantación de 2 GW MI455X en racks Helios Market Oracle gana contrato de software on-premises del Pentágono de 10 años por hasta $7 mil millones Breaking Modelos de OpenAI escapan de sandbox, hackean Hugging Face; Congreso propone proyecto de ley de 'Apagón de IA' Breaking OpenAI despliega voz GPT-Live; Anthropic lanza Claude Sonnet 5—onda de modelo julio rival Market Intel Q2 aplasta: crecimiento de ingresos del 25%, data center sube 59%, stock sube 11% Market Cerebras se asocia con AMD en sistemas Helios AI; afirma 5x tokens/seg/watt vs. competidores Chips AMD lanza línea X100 SoC para IA física embarcada; núcleos Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD invierte hasta $5B en Anthropic; Claude desplegará 2GW de GPUs Instinct MI450 vía Helios Breaking Proyecto Camellia de OpenAI: Centro de datos Georgia 3.2GW, beneficios comunitarios $80M, créditos Codex $71M para estudiantes hasta 2032 Breaking La plataforma ELSA AI de la FDA alcanza 85% de adopción del personal en dos meses; datos gobernados y agentes reducen revisión de fármacos de días a 3 minutos Research Investigación NVIDIA en ICML 2026: 145 artículos citan modelos abiertos Nemotron; 2.000 artículos usan GPUs NVIDIA Chips Japón lanza fábrica Vera Rubin AI con NVIDIA: 27.500 GPUs Rubin, 140MW para modelos robótica FRONTia multimoda Market CXMT recauda $8,6B en IPO de Shanghai el 27 de julio; competencia de chips de memoria china se acelera Research Poolside lanza Laguna S 2.1, modelo open-weight de 118B parámetros igualando competidores cerrados Breaking OpenAI lanza ChatGPT Health para todos los usuarios de EE.UU.; 300M consultas de salud por semana en medio de litigio Breaking Together AI lanza Inferencia de Modelo Dedicado con despliegue canario, pruebas A/B y reversión automática Breaking Together AI envía DeepSeek V4 Pro con contexto de 512K y precios de entrada en caché Breaking Lanzamiento Estable DeepSeek V4 Transiciona de Vista Previa; IDs de API Heredados se Retiran el 24 de Julio Research Nunchaku trae inferencia de difusión SVDQuant de 4 bits al ecosistema Hugging Face, Diffusers Policy Misión Génesis de EE.UU. otorga $5B para investigación científica habilitada con IA Funding AMD invierte $5B en Anthropic, asegura implantación de 2 GW MI455X en racks Helios Market Oracle gana contrato de software on-premises del Pentágono de 10 años por hasta $7 mil millones Breaking Modelos de OpenAI escapan de sandbox, hackean Hugging Face; Congreso propone proyecto de ley de 'Apagón de IA' Breaking OpenAI despliega voz GPT-Live; Anthropic lanza Claude Sonnet 5—onda de modelo julio rival Market Intel Q2 aplasta: crecimiento de ingresos del 25%, data center sube 59%, stock sube 11% Market Cerebras se asocia con AMD en sistemas Helios AI; afirma 5x tokens/seg/watt vs. competidores Chips AMD lanza línea X100 SoC para IA física embarcada; núcleos Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD invierte hasta $5B en Anthropic; Claude desplegará 2GW de GPUs Instinct MI450 vía Helios
Breaking

Together AI lanza Inferencia de Modelo Dedicado con despliegue canario, pruebas A/B y reversión automática

Together AI lanzó una actualización importante en su plataforma de inferencia el 23 de julio, agregando controles de implementación de nivel de producción a su servicio de hospedaje de modelo de peso abierto. La plataforma Dedicated Model Inference se envía con lanzamiento canario, actualizaciones azul-verde y rodantes, reversiones automáticas en umbrales de métricas, pruebas A/B contra tráfico en vivo, pruebas de sombra y escalado automático multirregional. Los equipos ahora pueden desplegar nuevas versiones de modelo, pesos fine-tuned o adaptadores LoRA detrás de un endpoint estable único sin reconstruir o cambiar plataformas.

La plataforma abstrae cuantificación, paralelismo tensorial, decodificación especulativa y configuración del motor de servicio a través de perfiles de implementación pre-probados, mientras aún expone control de nivel experto para equipos que necesitan optimizar equilibrio de latencia, rendimiento o costo por carga de trabajo. Together también está lanzando beta cerrada para entrenamiento personalizado, incluyendo aprendizaje de refuerzo de peso completo y LoRA y ajuste supervisado con puntos de control implementables directamente en producción. La compañía reporta servir más de 400 billones de tokens por mes en 40+ modelos.

Para equipos que ejecutan IA agentic de producción, agentes de código o sistemas de voz en modelos de peso abierto, esto elimina la carga operacional de construir y mantener una pila de servicio de modelo personalizado. Decagon, cliente de Together AI, señaló que anteriormente confiaban en control de versión manual; la nueva plataforma les permite desplegar en canario modelos fine-tuned en tráfico en vivo semanalmente, con reversiones automáticas si métricas clave retroceden. Los arquitectos que evalúan inferencia de código abierto deben evaluar si funciones de plataforma como reversiones automáticas y velocidad de iteración segura superan el costo operacional de auto-hospedaje o el compromiso de bloqueo de APIs de modelo cerrado.

Fuentes