Nvidia apresenta Nemotron 3 Ultra, MoE de 550 bilhões de parâmetros para agentes autônomos
Modelo chega em 4 de junho via Hugging Face e OpenRouter junto com o Agent Toolkit, suíte para colocar agentes em produção.
Pontos principais
- Nemotron 3 Ultra é um modelo MoE de 550 bilhões de parâmetros voltado a agentes de longa duração
- Nvidia promete inferência 5x mais rápida e custo 30% menor que modelos comparáveis
- Modelo chega em 4 de junho via Hugging Face, ModelScope e OpenRouter como NIM microservice
- Agent Toolkit reúne modelos, blueprints e ambiente seguro de runtime para agentes em escala
- Núcleo do toolkit é o NemoClaw, framework com templates para planejar, raciocinar, executar e delegar
Na GTC Taipei, paralela ao Computex, a Nvidia apresentou o Nemotron 3 Ultra, modelo de mistura de especialistas (MoE) com 550 bilhões de parâmetros construído para agentes autônomos de longa duração. A empresa diz que o modelo oferece inferência até cinco vezes mais rápida e custo de operação 30% menor que modelos comparáveis em sua classe, com lançamento agendado para 4 de junho via Hugging Face, ModelScope e OpenRouter.
O modelo vem acompanhado do Agent Toolkit, conjunto aberto de modelos, blueprints e ambiente seguro para colocar agentes em escala. No centro está o NemoClaw, framework com templates prontos para planejar, raciocinar, executar e delegar tarefas. As habilidades CUDA-X de agente já estão disponíveis no marketplace do Claude Code e no Hermes Skills Hub.
Comentários
Carregando comentários...
