Poolside lanza Laguna S 2.1, modelo open-weight de 118B superando DeepSeek V4 Flash en tareas agentísticas
Poolside lanzó Laguna S 2.1, un modelo base de open-weight de 118 mil millones de parámetros construido para codificación agentística el 21 de julio de 2026. En Terminal-Bench 2.0 y SWE-Bench Pro, Laguna S 2.1 coincide o supera modelos varias veces su tamaño, incluidos DeepSeek-V4-Flash, Nemotron 3 Ultra de NVIDIA o Thinking Machines' Inkling. Los pesos están disponibles en Hugging Face bajo una licencia OpenMDW-1.1.
En fijación de precios a nivel de token, Laguna S 2.1 cuesta $0,10 entrada / $0,20 salida por 1M tokens versus $0,14 / $0,28 para DeepSeek V4 Flash (Max), haciéndolo aproximadamente 30% más barato. En divisiones de benchmark, DeepSeek V4 Flash tiene la ventaja para codificación (promedio 68.8 vs 59.4), mientras que Laguna S 2.1 tiene la ventaja para tareas agentísticas (70.2 vs 63.8). En SWE-Bench Multilingual, Laguna alcanza 78.5%, colocándolo en rango con Tencent Hy3 y DeepSeek-V4-Pro Max, y en Toolathlon Verified puntua 49.7%, por delante de Nemotron 3 Ultra y DeepSeek-V4-Flash Max.
El lanzamiento llega cuando la pregunta sobre quién proporciona los modelos de pesos abiertos de Occidente se ha trasladado de círculos de investigación a salas de juntas y Washington, con el uso de desarrolladores cambiando hacia sistemas de pesos abiertos que los equipos pueden descargar, inspeccionar y ejecutar en su propia infraestructura. Para arquitectos evaluando pilas de codificación agentística, el peso localmente implementable de Laguna S 2.1, perfil de costos y liderazgo en tareas agentísticas lo hacen una alternativa práctica para modelos solo API; la compensación es latencia modesta y cobertura más estrecha fuera de evaluaciones específicas de código.