Poolside lança Laguna S 2.1, modelo aberto de 118B para programação
Modelo Mixture-of-Experts foi treinado em menos de nove semanas e é posicionado como a resposta ocidental aos laboratórios chineses de peso aberto.
Pontos principais
- O Laguna S 2.1 é um MoE de 118 bilhões de parâmetros no total, com 8 bilhões ativos por token.
- Tem janela de contexto de até 1 milhão de tokens e foi do início do treino ao lançamento em menos de nove semanas.
- Cabe em uma única NVIDIA DGX Spark; os pesos estão na Hugging Face sob a licença OpenMDW-1.1.
- Marcou pouco mais de 70% no Terminal-Bench 2.1 e quase 60% no SWE-Bench Pro.
- Iguala ou supera modelos de DeepSeek, Nvidia e Thinking Machines com 2 a 8 vezes mais parâmetros ativos.
- A Poolside reconhece que o modelo 'ainda não está na fronteira' ante sistemas fechados de OpenAI e Anthropic.
A Poolside lançou o Laguna S 2.1, um modelo de peso aberto voltado à programação com agentes e ao trabalho de longo prazo. Compacto o suficiente para rodar em uma única NVIDIA DGX Spark, o modelo teve os pesos publicados na Hugging Face desde o primeiro dia, nos formatos BF16, FP8, INT4 e NVFP4, sob a licença OpenMDW-1.1.
A empresa posicionou o lançamento como a resposta do Ocidente aos laboratórios chineses de peso aberto, afirmando que nenhum laboratório ocidental havia lançado um modelo dessa classe de 118 bilhões de parâmetros nos 11 meses anteriores. Ainda assim, a Poolside admite que o modelo não está na fronteira: sistemas de código fechado da OpenAI e da Anthropic seguem bem à frente nos mesmos benchmarks.
Comentários
Carregando comentários...
