---
title: "Nvidia lança modelo Nemotron 3.5 Lightning e roteador de IA"
url: https://dailyjournal.news/news/2026-08-11/nvidia-lanca-modelo-nemotron-35-lightning-com-foco-em-velocidade
published: 2026-08-11T13:32:32.798931+00:00
updated: 2026-08-11T17:32:59.98+00:00
categories: ["technology"]
topics: ["nvidia"]
source_count: 6
outlet_count: 1
language: pt-BR
publisher: "Daily Journal"
---

# Nvidia lança modelo Nemotron 3.5 Lightning e roteador de IA

A Nvidia apresentou o Nemotron 3.5 Lightning, modelo de 30 bilhões de parâmetros focado em velocidade, e o roteador Switchyard para otimizar agentes de IA.

## Pontos principais

- O Nemotron 3.5 Lightning utiliza arquitetura Mixture-of-Experts (MoE) com 30 bilhões de parâmetros totais e 3 bilhões ativos.
- A Nvidia afirma que o novo modelo entrega velocidades de saída até quatro vezes superiores às de modelos comparáveis.
- O NeMo Switchyard foi introduzido para rotear etapas de fluxos de agentes de IA ao modelo mais eficiente para cada tarefa.
- A combinação do modelo com o roteador pode reduzir custos operacionais para cerca de um terço em comparação ao uso de modelos de fronteira únicos.
- O modelo foi disponibilizado sob a licença permissiva OpenMDW-1.1, incluindo pesos e dados de treinamento.
- Parceiros como LangChain, Kong e OpenRouter já integraram suporte ao Switchyard em suas plataformas.
- O modelo está disponível para acesso via Hugging Face, ModelScope e como microsserviço NIM no ecossistema da Nvidia.

A Nvidia anunciou o lançamento do Nemotron 3.5 Lightning, um novo modelo de inteligência artificial de código aberto projetado para elevar a eficiência de agentes de longa duração. Com uma arquitetura híbrida que combina Mamba-Transformer e a tecnologia Mixture-of-Experts (MoE), o modelo possui 30 bilhões de parâmetros, sendo 3 bilhões ativos. A empresa destaca que a solução oferece uma velocidade de execução até quatro vezes maior que modelos concorrentes da mesma categoria, mantendo a precisão necessária para tarefas complexas. O lançamento ocorre em um momento em que a companhia expande seus esforços em open source, com relatos de mercado indicando que a empresa já trabalha no desenvolvimento do futuro Nemotron 4, que deve superar a marca de 1 trilhão de parâmetros. Para maximizar o desempenho do novo modelo, a Nvidia apresentou também o NeMo Switchyard, uma ferramenta de roteamento inteligente. O sistema é capaz de distribuir dinamicamente as etapas de um fluxo de trabalho de IA para o modelo mais adequado, otimizando o consumo de recursos. Segundo testes internos da Nvidia, a implementação conjunta do Lightning com o Switchyard pode reduzir os custos operacionais para cerca de um terço do valor necessário para rodar modelos de fronteira isolados, sem comprometer a taxa de conclusão de tarefas. A iniciativa visa atrair empresas que buscam reduzir gastos com tokens de IA e aumentar a agilidade de seus sistemas generativos. O suporte ao Switchyard já foi adotado por plataformas de infraestrutura e frameworks de desenvolvimento, como Kong, LiteLLM, OpenRouter e LangChain, facilitando a integração em ambientes corporativos. O Nemotron 3.5 Lightning está disponível em diversas plataformas, incluindo o Hugging Face e o ecossistema de microsserviços NIM da Nvidia, sob a licença permissiva OpenMDW-1.1.

## Fontes

- [Nemotron 3.5 Lightning entrega execução rápida e precisa de tarefas para agentes de longa duração](https://developer.nvidia.com/blog/nvidia-nemotron-3-5-lightning-delivers-fast-accurate-specialized-task-execution-for-long-running-agents/?nvid=nv-csfg-698644) (2026-08-11)
- [Nvidia Releases New Open Model](https://www.wsj.com/cio-journal/nvidia-releases-new-open-model-ee66e6a3?mod=rss_Technology) (2026-08-11)
- [Sources: Nvidia is developing a Nemotron 4 model with 1T+ parameters, up from Nemotron 3 Ultra's 550B parameters but smaller than leading Chinese open models (The Information)](https://www.techmeme.com/260811/p28#a260811p28) — Techmeme (2026-08-11)
- [Nvidia releases Nemotron 3.5 Lightning, an open 30B-parameter MoE model that it says delivers up to 4x faster output speeds, and an agentic AI model router (Kyt Dotson/SiliconANGLE)](https://www.techmeme.com/260811/p18#a260811p18) — Techmeme (2026-08-11)
- [Nemotron 3.5 Lightning e NeMo Switchyard entregam IA agêntica mais rápida e eficiente](https://blogs.nvidia.com/blog/nemotron-lightning-switchyard-rtx-dgx/) (2026-08-11)
- [Roteador Switchyard da Nvidia troca modelos no meio da tarefa e corta custos a um terço](https://venturebeat.com/orchestration/nvidias-switchyard-router-reshuffles-ai-models-mid-task-cutting-task-costs-to-a-third) (2026-08-11)

## Tópicos relacionados

- [NVIDIA](https://dailyjournal.news/topics/nvidia)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-08-11/nvidia-lanca-modelo-nemotron-35-lightning-com-foco-em-velocidade
