---
title: "Alibaba lança Qwen3.6-35B-A3B, modelo aberto que corta 90% do custo computacional"
url: https://dailyjournal.news/news/2026-04-17/alibaba-lanca-qwen36-35b-a3b-modelo-aberto-que-corta-90-do-custo-computacional
published: 2026-04-17T12:00:00+00:00
categories: ["technology"]
source_count: 1
outlet_count: 0
language: pt-BR
publisher: "Daily Journal"
---

# Alibaba lança Qwen3.6-35B-A3B, modelo aberto que corta 90% do custo computacional

Modelo de mistura de especialistas tem 35 bilhões de parâmetros totais mas apenas 3 bilhões ativos por token; versão comprimida roda em hardware doméstico.

## Pontos principais

- Arquitetura MoE: 256 especialistas, 9 ativados por camada, reduzindo custo em ~90%
- 73,4% no SWE-bench Verified, superando Gemma4-31B do Google por 21,4 pontos
- Licença Apache 2.0 sem restrições de uso
- Versão quantizada de 21 GB roda em RTX 4090 ou MacBook M5
- Suporte nativo a texto, imagem e vídeo, com até 224K tokens de vídeo

A Alibaba publicou o Qwen3.6-35B-A3B, modelo de linguagem sob licença aberta baseado em mistura de especialistas (MoE). Com 35 bilhões de parâmetros totais mas apenas 3 bilhões ativos por token, o modelo reduz o custo computacional em cerca de 90% em relação a arquiteturas densas equivalentes.

No SWE-bench Verified, atinge 73,4%, superando o Gemma4-31B do Google por 21,4 pontos. O modelo é nativamente multimodal, processando texto, imagem e vídeos de até uma hora. Uma versão comprimida de 21 GB roda em placas de vídeo domésticas como a RTX 4090.

## Fontes

- [Qwen3.6: IA de código aberto supera modelos 10x maiores](https://byteiota.com/qwen3-6-open-source-ai-beats-models-10x-its-size/) (2026-04-17)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-04-17/alibaba-lanca-qwen36-35b-a3b-modelo-aberto-que-corta-90-do-custo-computacional
