Nvidia lança modelo Nemotron 3.5 Lightning com foco em velocidade
O novo modelo de 30 bilhões de parâmetros promete reduzir custos e aumentar em até quatro vezes a velocidade de saída de sistemas de IA.
Pontos principais
- O Nemotron 3.5 Lightning utiliza a arquitetura Mixture-of-Experts (MoE) com 30 bilhões de parâmetros.
- A Nvidia afirma que o modelo entrega velocidades de processamento até quatro vezes superiores às versões anteriores.
- A empresa disponibilizou o modelo como código aberto para aumentar a flexibilidade de desenvolvedores.
- Um novo roteador de modelos foi introduzido para otimizar o funcionamento de agentes de inteligência artificial.
A Nvidia anunciou o lançamento do Nemotron 3.5 Lightning, um modelo de linguagem de código aberto projetado para elevar a eficiência de aplicações de inteligência artificial generativa. Com uma arquitetura baseada em Mixture-of-Experts (MoE) e 30 bilhões de parâmetros, a ferramenta foca na redução de custos operacionais e na otimização do consumo de tokens. Segundo a companhia, o modelo consegue atingir velocidades de saída até quatro vezes mais rápidas do que as iterações anteriores, atendendo a uma demanda crescente do mercado corporativo por sistemas mais ágeis e econômicos. Além do modelo, a Nvidia introduziu um roteador de modelos voltado para agentes de IA, visando melhorar a personalização e o desempenho de fluxos de trabalho automatizados. A iniciativa reforça a estratégia da empresa em fornecer soluções de infraestrutura que equilibrem alto desempenho computacional com maior acessibilidade para desenvolvedores.
Tópicos relacionados
Comentários
Carregando comentários...
