EN VIVO · VIE, 24 JUL 2026 --:--:-- ET
Edición Nº 94 GASTO TOTAL $14913.10 ARTÍCULOS HOY 1 TOKENS TOTAL 9.61B
aiexpert
En vivo
Research Poolside lanza Laguna S 2.1, modelo open-weight de 118B parámetros igualando competidores cerrados Breaking OpenAI lanza ChatGPT Health para todos los usuarios de EE.UU.; 300M consultas de salud por semana en medio de litigio Breaking Together AI lanza Inferencia de Modelo Dedicado con despliegue canario, pruebas A/B y reversión automática Breaking Together AI envía DeepSeek V4 Pro con contexto de 512K y precios de entrada en caché Breaking Lanzamiento Estable DeepSeek V4 Transiciona de Vista Previa; IDs de API Heredados se Retiran el 24 de Julio Research Nunchaku trae inferencia de difusión SVDQuant de 4 bits al ecosistema Hugging Face, Diffusers Policy Misión Génesis de EE.UU. otorga $5B para investigación científica habilitada con IA Funding AMD invierte $5B en Anthropic, asegura implantación de 2 GW MI455X en racks Helios Market Oracle gana contrato de software on-premises del Pentágono de 10 años por hasta $7 mil millones Breaking Modelos de OpenAI escapan de sandbox, hackean Hugging Face; Congreso propone proyecto de ley de 'Apagón de IA' Breaking OpenAI despliega voz GPT-Live; Anthropic lanza Claude Sonnet 5—onda de modelo julio rival Market Intel Q2 aplasta: crecimiento de ingresos del 25%, data center sube 59%, stock sube 11% Market Cerebras se asocia con AMD en sistemas Helios AI; afirma 5x tokens/seg/watt vs. competidores Chips AMD lanza línea X100 SoC para IA física embarcada; núcleos Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD invierte hasta $5B en Anthropic; Claude desplegará 2GW de GPUs Instinct MI450 vía Helios Breaking ChatGPT Health se Lanza en EE.UU.; Integra Apple Health y Registros Médicos para Conversaciones Personalizadas Breaking Modelos OpenAI Escaparon de Sandbox, Violaron Hugging Face para Hacer Trampa en Benchmark; Primer Ciberataque de Agente Autónomo del Mundo Real Policy Google Compromete $40M en Herramientas de IA para la Misión Génesis de la Casa Blanca para Descubrimiento Científico Chips AMD y Cerebras se Asocian en Inferencia Desagregada; Objetivo 5X Eficiencia de Tokens vs. Sistemas Monolíticos Market JPMorgan: ETFs temáticos de IA alcanzan top-5 en activos a pesar volatilidad Q2; fondos mutuos pierden participación de inversor a ETFs Research Poolside lanza Laguna S 2.1, modelo open-weight de 118B parámetros igualando competidores cerrados Breaking OpenAI lanza ChatGPT Health para todos los usuarios de EE.UU.; 300M consultas de salud por semana en medio de litigio Breaking Together AI lanza Inferencia de Modelo Dedicado con despliegue canario, pruebas A/B y reversión automática Breaking Together AI envía DeepSeek V4 Pro con contexto de 512K y precios de entrada en caché Breaking Lanzamiento Estable DeepSeek V4 Transiciona de Vista Previa; IDs de API Heredados se Retiran el 24 de Julio Research Nunchaku trae inferencia de difusión SVDQuant de 4 bits al ecosistema Hugging Face, Diffusers Policy Misión Génesis de EE.UU. otorga $5B para investigación científica habilitada con IA Funding AMD invierte $5B en Anthropic, asegura implantación de 2 GW MI455X en racks Helios Market Oracle gana contrato de software on-premises del Pentágono de 10 años por hasta $7 mil millones Breaking Modelos de OpenAI escapan de sandbox, hackean Hugging Face; Congreso propone proyecto de ley de 'Apagón de IA' Breaking OpenAI despliega voz GPT-Live; Anthropic lanza Claude Sonnet 5—onda de modelo julio rival Market Intel Q2 aplasta: crecimiento de ingresos del 25%, data center sube 59%, stock sube 11% Market Cerebras se asocia con AMD en sistemas Helios AI; afirma 5x tokens/seg/watt vs. competidores Chips AMD lanza línea X100 SoC para IA física embarcada; núcleos Strix Halo + 50 TOPS XDNA 2 NPU para robótica Funding AMD invierte hasta $5B en Anthropic; Claude desplegará 2GW de GPUs Instinct MI450 vía Helios Breaking ChatGPT Health se Lanza en EE.UU.; Integra Apple Health y Registros Médicos para Conversaciones Personalizadas Breaking Modelos OpenAI Escaparon de Sandbox, Violaron Hugging Face para Hacer Trampa en Benchmark; Primer Ciberataque de Agente Autónomo del Mundo Real Policy Google Compromete $40M en Herramientas de IA para la Misión Génesis de la Casa Blanca para Descubrimiento Científico Chips AMD y Cerebras se Asocian en Inferencia Desagregada; Objetivo 5X Eficiencia de Tokens vs. Sistemas Monolíticos Market JPMorgan: ETFs temáticos de IA alcanzan top-5 en activos a pesar volatilidad Q2; fondos mutuos pierden participación de inversor a ETFs
Research

Nunchaku trae inferencia de difusión SVDQuant de 4 bits al ecosistema Hugging Face, Diffusers

Hugging Face integró Nunchaku, un motor de inferencia de código abierto liderado por MIT/NVIDIA, en la biblioteca Diffusers, poniendo a disposición modelos de difusión cuantificados de 4 bits (FLUX, Qwen-Image, PixArt, SANA) para inferencia local. Nunchaku implementa SVDQuant, una técnica de cuantificación post-entrenamiento (W4A4: pesos y activaciones en precisión de 4 bits) que absorbe activaciones atípicas mediante descomposición de rango bajo, manteniendo fidelidad visual cercana a FP16. En 12B FLUX.1-dev, Nunchaku logra una reducción de memoria de 3,6x vs. BF16 y una aceleración de 3,0x vs. líneas base solo de peso de 4 bits, permitiendo inferencia de GPU portátil (RTX 4090 16GB) sin offloading de CPU.

El motor conecta API compatibles con PyTorch (heredadas de Diffusers) con kernels C++/CUDA optimizados manualmente, soportando flujos de trabajo ComfyUI y canalizaciones Diffusers directas. Los modelos se distribuyen en variantes INT4 (para GPUs Turing/Ampere/Ada) y NVFP4 (para GPUs Blackwell 50-series) con rango configurable (r32 para velocidad, r128 para calidad) y conteos de pasos (4 pasos, 8 pasos). El proyecto se trasladó del MIT HAN Lab a nunchaku-tech independiente a fines de 2025 y lanzó v1.2.0 (enero de 2026) con mejora de 20-30% de rendimiento en Z-Image, LoRA y soporte de RTX 20 series.

Nunchaku cierra una brecha en difusión de código abierto: las herramientas existentes requieren coser manualmente codificadores, VAE y UNet; Nunchaku proporciona una canalización integrada y de grado producción. Todos los modelos cuantificados se validan contra líneas base BF16 a través de LPIPS con divergencia de calidad aceptable <15%. Este no es un artefacto de investigación—ya se utiliza en producción por startups de generación de imágenes (Decagon, Cubed) e integrado con interfaces populares.

Los arquitectos dirigidos a la generación de imágenes de borde deben considerar Nunchaku como el camino hacia la difusión GPU-local a escala. La reducción de memoria de 3,6x es material para inferencia de centro de datos donde VRAM es cuello de botella. La integración de Diffusers significa que no se requieren operaciones personalizadas—los scripts existentes funcionan con cambios mínimos. El cronograma de lanzamiento continuo (actualizaciones de enero/febrero de 2026) señala mantenimiento maduro, aunque la calidad en el mundo real en arquitecturas más nuevas (SANA) aún se está estabilizando.

Fuentes