NVIDIA lanzó el 11 de agosto Nemotron 3.5 Lightning, un modelo open-source de 30 mil millones de parámetros con arquitectura mixture-of-experts diseñado para cargas de trabajo de IA agéntica. El modelo ofrece velocidad de salida hasta 4x más rápida y permite conclusión de tareas agénticas 30% más rápida comparado con otros modelos de su clase, según benchmarks PinchBench de NVIDIA. Lightning es completamente personalizable y se ejecuta en hardware local, incluyendo PCs RTX, workstations DGX y dispositivos edge Jetson, dando a las empresas control sobre privacidad de datos e implementación.
Junto a Lightning, NVIDIA lanzó NeMo Switchyard, una biblioteca de enrutamiento open-source que dirige inteligentemente solicitudes al modelo más capaz para cada tarea, reduciendo costos de inferencia a aproximadamente un tercio de Claude Opus 4.8 solo manteniendo acurácia de nivel frontier. Socios empresariales incluyendo CrowdStrike, Harvey y CodeRabbit ya están personalizando Lightning para tareas específicas del dominio.
El movimiento de NVIDIA se alinea con la declaración de julio del CEO Jensen Huang de que la IA open-source gratuita es buena para ventas de chips, posicionando Nemotron contra competidores chinos como DeepSeek V3 y Alibaba Qwen3.5. El modelo está disponible en Hugging Face y vía microservicios NVIDIA NIM, con datos de entrenamiento y recetas publicados abiertamente para transparencia y reproducibilidad. Los arquitectos implementando flujos de trabajo agénticos se benefician de la eficiencia de costos y flexibilidad de implementación local, particularmente para sistemas multi-modelo requiriendo latencia sub-segundo.