---
title: "Vera Rubin NVL72 estreia no MLPerf com throughput até 3,7x o do GB300"
url: https://dailyjournal.news/news/2026-09-17/vera-rubin-nvl72-estreia-no-mlperf-com-throughput-ate-37x-o-do-gb300
published: 2026-09-17T12:00:00+00:00
categories: ["technology", "business"]
source_count: 5
outlet_count: 0
language: pt-BR
publisher: "Daily Journal"
---

# Vera Rubin NVL72 estreia no MLPerf com throughput até 3,7x o do GB300

A rodada v6.1 do MLPerf Inference teve recorde de 30 organizações e estreou cinco processadores, incluindo AMD MI350P e Intel Arc Pro B70.

## Pontos principais

- A MLCommons divulgou em 16 de setembro de 2026 os resultados do MLPerf Inference v6.1, com recorde de 30 organizações submetendo.
- Estrearam cinco processadores: AMD Ryzen AI Max+ 395, AMD Instinct MI350P e Intel Arc Pro B70 (disponíveis), além de Nvidia Rubin e Vera Rubin NVL72 (preview).
- No Qwen3-VL, o Vera Rubin NVL72 entregou throughput até 3,7 vezes maior que o do GB300 NVL72, com vLLM e o framework aberto Nvidia Dynamo.
- No DeepSeek-R1, com a biblioteca Nvidia TensorRT-LLM, o ganho foi de até 2,5 vezes sobre o GB300 NVL72.
- Em testes preliminares no AgentX, benchmark externo de tarefas agênticas da SemiAnalysis, a Nvidia diz que o Vera Rubin teve desempenho até 30 vezes superior ao do GB300 NVL72.
- Uma submissão de DeepSeek-R1 com 288 GPUs em quatro racks GB300 NVL72 atingiu 99% de eficiência de escala no cenário offline.
- No benchmark de geração de vídeo WAN 2.2, o GB300 NVL72 processou 0,65 vídeo em 720p por segundo (5,7 segundos por vídeo), com throughput 9 vezes maior e latência 7,5 vezes menor que um único nó.
- Só as otimizações de software elevaram os resultados do v6.1 em até 1,6 vez frente ao v6.0.
- A Nvidia diz ter seguido otimizando o software após o prazo de submissão da v6.1, com ganhos adicionais em GPT-OSS-120B e DLRMv3 ainda não verificados pela MLCommons.
- No teste DeepSeek-R1, o melhor resultado por acelerador no cenário server foi 5,7 vezes maior que um ano antes, na v5.1.
- A rodada acrescentou um benchmark de RAG ponta a ponta e um de inferência agêntica em edge, este testado pela Nvidia com o Jetson AGX Thor e o modelo Qwen3.6-27B.

O Vera Rubin entrou em produção plena, com sistemas previstos para começar a ser enviados no outono de 2026 no hemisfério norte. Os resultados em preview são a primeira medição revisada por pares da plataforma.

Separadamente, em um encontro de executivos de IA na Escócia, Jensen Huang disse que a Nvidia espera vender em 2027 o dobro de chips que em 2026.

## Fontes

- [MLCommons publica resultados do MLPerf Inference v6.1](https://mlcommons.org/2026/09/mlperf-inference-v6-1-results/) (2026-09-17)
- [Vera Rubin entra em produção plena com envios no outono](https://thedigginator.com/nvidia-vera-rubin-nvl72-mlperf-inference/) (2026-09-17)
- [Vera Rubin NVL72 publica primeiros resultados de inferência no MLPerf](https://blogs.nvidia.com/blog/vera-rubin-nvl72-mlperf-inference/) (2026-09-17)
- [Huang projeta dobrar vendas de chips em 2027](https://www.tradingkey.com/analysis/stocks/us-stocks/262173235-nvidia-stock-rise-jensen-huang-2027-chip-sales-double-tradingkey) (2026-09-17)
- [Cinco novos aceleradores estreiam no MLPerf Inference v6.1](https://www.unite.ai/nvidia-vera-rubin-nvl72-posts-first-mlperf-inference-preview-results/) (2026-09-17)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-09-17/vera-rubin-nvl72-estreia-no-mlperf-com-throughput-ate-37x-o-do-gb300
