---
title: "Nvidia revela Groq 3 LPU e Vera CPU para inferência agêntica"
url: https://dailyjournal.news/news/2026-03-17/nvidia-revela-groq-3-lpu-e-vera-cpu-para-inferencia-agentica
published: 2026-03-17T12:00:00+00:00
categories: ["technology"]
source_count: 3
outlet_count: 0
language: pt-BR
publisher: "Daily Journal"
---

# Nvidia revela Groq 3 LPU e Vera CPU para inferência agêntica

Groq 3 com 500 MB de SRAM on-chip entrega 35x mais throughput por megawatt; Vera CPU com 88 núcleos Olympus sustenta 22.500 ambientes simultâneos.

## Pontos principais

- Groq 3 LPU tem 500 MB de SRAM on-chip com 150 TB/s de bandwidth de memória
- Rack LPX com 256 LPUs entrega 315 PFLOPS (FP8) e 128 GB de SRAM total
- GPUs processam prompts enquanto LPUs geram tokens a latência ultrabaixa
- Throughput 35x maior por megawatt em comparação com sistemas anteriores
- Vera CPU com 88 núcleos Olympus é 50% mais rápido que x86
- Rack Vera sustenta 22.500+ ambientes simultâneos para agentes de IA

O Groq 3 LPU, primeiro chip resultante da aquisição de US$ 20 bilhões da Groq Inc. em dezembro de 2025, utiliza arquitetura baseada em SRAM com 500 MB de memória on-chip a 150 TB/s de bandwidth. O rack líquido-refrigerado LPX empilha 256 LPUs entregando 315 PFLOPS (FP8) e 40 PB/s de bandwidth on-chip. A arquitetura complementar coloca GPUs no prefill e LPUs na geração de tokens, alcançando velocidades próximas a 1.000 tokens por segundo por usuário.

O Vera CPU, primeiro processador próprio da Nvidia, traz 88 núcleos Olympus com tecnologia Spatial Multithreading, 50% mais rápidos e duas vezes mais eficientes que CPUs x86. Seu subsistema LPDDR5X entrega 1,2 TB/s de bandwidth — o dobro de CPUs tradicionais pela metade da energia. Um rack com 256 chips sustenta mais de 22.500 ambientes simultâneos para agentes de IA.

## Fontes

- [Nvidia reinventa a CPU para a era da IA agêntica](https://siliconangle.com/2026/03/16/nvidia-reinvents-cpu-age-agentic-ai/) (2026-03-17)
- [Por dentro do Groq 3 LPX: acelerador de inferência de baixa latência para a plataforma Vera Rubin](https://developer.nvidia.com/blog/inside-nvidia-groq-3-lpx-the-low-latency-inference-accelerator-for-the-nvidia-vera-rubin-platform/) (2026-03-17)
- [Nvidia anuncia chip de inferência Groq 3 LPU e rack com 256 LPUs](https://www.datacenterdynamics.com/en/news/nvidia-announces-groq-3-lpu-ai-inference-chip-plans-256-lpu-rack/) (2026-03-17)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-03-17/nvidia-revela-groq-3-lpu-e-vera-cpu-para-inferencia-agentica
