Ministral 3 3B Instruct 2512 é um modelo multimodal de 3,4B parâmetros (+ encoder de visão de 0,4B) da Mistral, com janela de contexto de 256k tokens, licença Apache 2.0 e footprint de 8GB VRAM em FP8 — posicionado para inferência de borda com visão nativa e function calling.
El laboratorio no publicó benchmark verificable para este modelo.
Combinar visão, contexto longo de 256k e function calling em um modelo que cabe em 8GB de VRAM elimina uma classe inteira de trade-offs que forçava arquitetos a escolher entre capacidade multimodal e viabilidade de borda. A licença Apache 2.0 permite uso comercial sem restrições, o que é relevante para implantações em setores regulados onde modelos proprietários criam dependência contratual.
Os benchmarks de raciocínio da família Ministral 3 14B superam o Qwen3-14B em AIME25 (0,850 vs. 0,737) e GPQA Diamond (0,712 vs. 0,663), sinalizando que a Mistral está competindo diretamente com a Qwen no segmento de modelos densos de médio porte — pressão que beneficia o ecossistema open-weight como um todo.
Engenheiros de MLOps e CTOs em manufatura, saúde e varejo que precisam processar imagens e documentos longos em dispositivos com GPU limitada (edge servers, laptops corporativos) sem depender de APIs externas; arquitetos de sistemas agênticos que buscam um modelo de baixo custo para orquestração de ferramentas com saída JSON confiável em pipelines de automação local.