Meta lanzó Muse Glimmer, un modelo de código abierto de 30 mil millones de parámetros diseñado para ejecutarse en una sola GPU de consumidor en una Mac o PC, optimizado para flujos de trabajo agenticos en dispositivo. El modelo se lanza bajo una licencia permisiva Apache 2.0 a través de Hugging Face, con integraciones para llama.cpp, MLX y ExecuTorch llegando en los próximos días. Meta también se comprometió a abrir el código de los pesos de su modelo insignia Muse Spark 1.2.
Muse Glimmer se obtiene mediante destilación del Muse Spark usando una receta de entrenamiento novedosa que transfiere razonamiento agentico del modelo maestro más grande, agregando cuantización e optimizaciones de inferencia. El modelo fue evaluado contra DeepSeek QA, SWE-Bench y otros puntos de referencia de tareas agenticas de extremo a extremo, demostrando un fuerte desempeño en el uso de herramientas, razonamiento de múltiples pasos y recuperación de fallos.
Para arquitectos que construyen pilas de IA locales, Muse Glimmer aborda las penalizaciones de costo y latencia de la inferencia en la nube, posicionando a Meta directamente contra laboratorios de código abierto chinos (DeepSeek, Moonshot, Alibaba) que dominan el espacio de modelos eficientes. El ensayo complementario de 6.500 palabras del CEO Zuckerberg desafió directamente las barreras políticas estadounidenses sobre destilación y restricciones de datos de entrenamiento que argumenta que perjudican a los laboratorios de código abierto estadounidenses frente a competidores extranjeros.