CoreWeave disponibiliza modelo Kimi K3 em sua plataforma de inferência
A CoreWeave integrou o modelo Kimi K3, com 2,8 trilhões de parâmetros, à sua infraestrutura de inferência dedicada baseada em GPUs Nvidia.
||
07/09 às 10:10
Pontos principais
- O modelo Kimi K3 conta com 2,8 trilhões de parâmetros.
- A ferramenta suporta uma janela de contexto de 1 milhão de tokens.
- A execução é realizada por meio de infraestrutura com GPUs da Nvidia.
- O serviço inclui recursos de autoscaling e roteamento automático para usuários.
A CoreWeave anunciou a disponibilidade do modelo Kimi K3 em sua plataforma de inferência dedicada. O modelo, que possui 2,8 trilhões de parâmetros, oferece suporte a uma janela de contexto de 1 milhão de tokens. A infraestrutura utilizada para a execução da inferência é composta por GPUs da Nvidia. Além do acesso ao modelo, o serviço disponibiliza aos usuários funcionalidades de autoscaling e roteamento automático para otimizar o desempenho das operações.
Comentários
Carregando comentários...
