Daily Journal
Daily Journal

Meituan abre código do LongCat-2.0, modelo de 1,6 tri treinado em chips chineses

Modelo Mixture-of-Experts roda em cluster de mais de 50.000 chips domésticos e teria desempenho comparável ao Gemini 3.1 Pro.

Daily Journal
||
30/06 às 09:00

Pontos principais

  • Lançado e com código aberto na terça-feira, 30 de junho, sob licença MIT (GitHub, Hugging Face e plataforma própria).
  • Modelo Mixture-of-Experts com 1,6 trilhão de parâmetros totais, ativando ~48 bilhões por token.
  • Janela de contexto nativa de 1 milhão de tokens.
  • Primeiro modelo de trilhão de parâmetros pré-treinado e executado em mais de 50.000 ASICs feitos na China, sem GPUs da Nvidia.
  • Meituan diz que o desempenho é comparável ao Gemini 3.1 Pro, do Google.
  • Era o modelo anônimo 'Owl Alpha', líder na OpenRouter nos últimos dois meses.

A Meituan, gigante chinesa de entregas, abriu o código de seu maior modelo de linguagem até hoje, o LongCat-2.0, distribuído sob a permissiva licença MIT. O modelo Mixture-of-Experts soma 1,6 trilhão de parâmetros totais, ativa cerca de 48 bilhões por token e traz janela de contexto nativa de 1 milhão de tokens.

O destaque está no hardware: é o primeiro modelo de trilhão de parâmetros totalmente pré-treinado e executado em um cluster de mais de 50.000 ASICs fabricados na China, sem GPUs da Nvidia. A Meituan não revelou o fabricante dos chips e afirma que o desempenho rivaliza com o Gemini 3.1 Pro, do Google. O LongCat-2.0 era o modelo anônimo 'Owl Alpha', que liderou os rankings globais de desenvolvedores na OpenRouter nos últimos dois meses.

Comentários

Carregando comentários...