Meituan abre código do LongCat-2.0, modelo de 1,6 tri treinado em chips chineses
Modelo Mixture-of-Experts roda em cluster de mais de 50.000 chips domésticos e teria desempenho comparável ao Gemini 3.1 Pro.
Pontos principais
- Lançado e com código aberto na terça-feira, 30 de junho, sob licença MIT (GitHub, Hugging Face e plataforma própria).
- Modelo Mixture-of-Experts com 1,6 trilhão de parâmetros totais, ativando ~48 bilhões por token.
- Janela de contexto nativa de 1 milhão de tokens.
- Primeiro modelo de trilhão de parâmetros pré-treinado e executado em mais de 50.000 ASICs feitos na China, sem GPUs da Nvidia.
- Meituan diz que o desempenho é comparável ao Gemini 3.1 Pro, do Google.
- Era o modelo anônimo 'Owl Alpha', líder na OpenRouter nos últimos dois meses.
A Meituan, gigante chinesa de entregas, abriu o código de seu maior modelo de linguagem até hoje, o LongCat-2.0, distribuído sob a permissiva licença MIT. O modelo Mixture-of-Experts soma 1,6 trilhão de parâmetros totais, ativa cerca de 48 bilhões por token e traz janela de contexto nativa de 1 milhão de tokens.
O destaque está no hardware: é o primeiro modelo de trilhão de parâmetros totalmente pré-treinado e executado em um cluster de mais de 50.000 ASICs fabricados na China, sem GPUs da Nvidia. A Meituan não revelou o fabricante dos chips e afirma que o desempenho rivaliza com o Gemini 3.1 Pro, do Google. O LongCat-2.0 era o modelo anônimo 'Owl Alpha', que liderou os rankings globais de desenvolvedores na OpenRouter nos últimos dois meses.
Comentários
Carregando comentários...
