Nvidia registra 3.400 tokens por segundo com racks Groq 3 LPX
A Nvidia atingiu alta performance em benchmark com o modelo Gemma 4 31B, destacando o retorno de seu investimento na tecnologia LPU da Groq.
Pontos principais
- Os racks Groq 3 LPX alcançaram a marca de 3.400 tokens por segundo em testes da Artificial Analysis.
- O benchmark utilizou o modelo Gemma 4 31B com uma sequência de entrada de 100.000 tokens.
- O resultado valida o investimento de 20 bilhões de dólares feito pela Nvidia na tecnologia LPU da Groq.
A Nvidia divulgou resultados expressivos de desempenho para seus novos racks Groq 3 LPX, que registraram a marca de 3.400 tokens por segundo em um benchmark conduzido pela Artificial Analysis. O teste, realizado com o modelo Gemma 4 31B e uma sequência de entrada de 100.000 tokens, demonstra a capacidade de processamento da infraestrutura em cargas de trabalho complexas de IA. Este marco é visto pela companhia como uma validação estratégica do seu investimento de 20 bilhões de dólares na tecnologia LPU (Language Processing Unit) da Groq. A eficiência demonstrada reforça a competitividade da Nvidia no mercado de hardware para LLMs, onde a velocidade de inferência é um diferencial crítico para a escalabilidade de aplicações de inteligência artificial generativa. O avanço reflete o compromisso da empresa em otimizar a infraestrutura de data center para atender à crescente demanda por processamento de modelos de linguagem de grande escala.
Comentários
Carregando comentários...
