---
title: "Mistral lança Small 4: MoE de 119B parâmetros com 6,5B ativos por token"
url: https://dailyjournal.news/news/2026-03-16/mistral-lanca-small-4-moe-de-119b-parametros-com-65b-ativos-por-token
published: 2026-03-16T12:00:00+00:00
categories: ["technology"]
source_count: 1
outlet_count: 0
language: pt-BR
publisher: "Daily Journal"
---

# Mistral lança Small 4: MoE de 119B parâmetros com 6,5B ativos por token

Primeiro modelo a unificar instruct, raciocínio e multimodal num único deploy Apache 2.0 com 256K de contexto.

## Pontos principais

- 119B parâmetros totais com 128 experts e apenas 6,5B ativos por token
- Unifica quatro modelos anteriores: Mistral Small, Magistral, Pixtral e Devstral
- 256K tokens de contexto com Multi-head Latent Attention (MLA)
- 40% menos latência e 3x mais requisições por segundo vs Small 3
- GPQA Diamond de 71,2 e MMLU-Pro de 78,0
- Licença Apache 2.0 com pesos abertos

A Mistral AI lançou o Mistral Small 4, modelo Mixture-of-Experts com 119 bilhões de parâmetros totais, 128 experts e apenas 6,5 bilhões de parâmetros ativos por token. É o primeiro modelo a unificar instruct, raciocínio, multimodal e coding agêntico num único deploy, substituindo quatro modelos anteriores.

Com 256K tokens de contexto, modo de raciocínio alternável por requisição e function calling nativo, o Small 4 entrega 40% menos latência e 3x mais requisições por segundo que o Small 3. Roda em 2 GPUs via vLLM com quantização NVFP4 disponível, sob licença Apache 2.0.

## Fontes

- [Mistral Small 4: modelo MoE de 119B parâmetros no Hugging Face](https://huggingface.co/mistralai/Mistral-Small-4-119B-2603) (2026-03-16)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-03-16/mistral-lanca-small-4-moe-de-119b-parametros-com-65b-ativos-por-token
