Alibaba lança modelo de IA Qwen3.8-Flash com foco em eficiência
O novo modelo multimodal da Alibaba promete alto desempenho em tarefas de codificação e escritório com custos reduzidos para usuários comerciais.
Pontos principais
- O Qwen3.8-Flash possui 125 bilhões de parâmetros, com 6 bilhões ativados por token.
- A janela de contexto padrão é de 262.144 tokens, podendo chegar a 1 milhão.
- O tempo de treinamento do modelo foi reduzido em nove vezes em comparação ao Qwen3.7-Plus.
- O serviço custa US$ 0,16 por milhão de tokens de entrada e US$ 0,47 por milhão de saída.
- Pesos de código aberto da versão Qwen3.8-Flash-Next foram publicados no Hugging Face e ModelScope.
A Alibaba anunciou o lançamento do Qwen3.8-Flash, um modelo multimodal de inteligência artificial projetado para otimizar custos e elevar a eficiência em tarefas de escritório e programação. Com uma arquitetura robusta de 125 bilhões de parâmetros, o modelo se destaca pela agilidade, apresentando um tempo de treinamento nove vezes menor que o seu antecessor, o Qwen3.7-Plus. A flexibilidade é outro ponto central, oferecendo uma janela de contexto que atinge até 1 milhão de tokens, permitindo o processamento de grandes volumes de dados em uma única interação. A estratégia comercial da empresa foca na competitividade, com preços acessíveis para o uso de sua API. Além disso, a disponibilização dos pesos da versão Qwen3.8-Flash-Next em plataformas como Hugging Face e ModelScope reforça o compromisso da Alibaba com o ecossistema de código aberto, facilitando a adoção da tecnologia por desenvolvedores e empresas ao redor do mundo.
Tópicos relacionados
Comentários
Carregando comentários...
