---
title: "Inception Labs lança Mercury 2, primeiro modelo de raciocínio baseado em difusão"
url: https://dailyjournal.news/news/2026-02-26/inception-labs-lanca-mercury-2-primeiro-modelo-de-raciocinio-baseado-em-difusao
published: 2026-02-26T21:39:46.490447+00:00
categories: ["technology"]
source_count: 2
outlet_count: 0
language: pt-BR
publisher: "Daily Journal"
---

# Inception Labs lança Mercury 2, primeiro modelo de raciocínio baseado em difusão

Mercury 2 atinge 1.009 tokens por segundo em GPUs Blackwell via geração paralela em vez de decodificação autorregressiva, a $0,25/M tokens de entrada.

## Pontos principais

- Primeiro modelo de raciocínio construído sobre difusão em vez de decodificação autorregressiva
- 1.009 tokens por segundo em GPUs Nvidia Blackwell — 5x mais rápido que modelos otimizados para velocidade
- Gera respostas por refinamento paralelo em vez de token por token
- Preço de $0,25/M tokens de entrada e $0,75/M tokens de saída
- Fundada por pesquisadores de Stanford, UCLA e Cornell responsáveis por trabalho fundacional em difusão
- Suporta raciocínio ajustável, janela de contexto de 128K, tool use nativo e saída JSON

A Inception Labs lançou o Mercury 2, o primeiro modelo de raciocínio linguístico comercial construído sobre difusão em vez de decodificação autorregressiva. Em vez de gerar tokens sequencialmente (um de cada vez, da esquerda para a direita), o Mercury 2 produz respostas por refinamento paralelo — gerando múltiplos tokens simultaneamente e convergindo em poucos passos.

O resultado é velocidade de 1.009 tokens por segundo em GPUs Nvidia Blackwell, mais de 5x mais rápido que os modelos otimizados para velocidade existentes, a $0,25 por milhão de tokens de entrada. A vantagem de velocidade vem da arquitetura do modelo, não de otimizações de hardware, e permite corrigir erros no meio da geração.

## Fontes

- [Apresentando Mercury 2 — o LLM de raciocínio mais rápido do mundo](https://www.inceptionlabs.ai/blog/introducing-mercury-2) (2026-02-24)
- [Inception lança Mercury 2, o LLM de raciocínio mais rápido — 5x mais rápido que LLMs otimizados para velocidade](https://www.businesswire.com/news/home/20260224034496/en/Inception-Launches-Mercury-2-the-Fastest-Reasoning-LLM-5x-Faster-Than-Leading-Speed-Optimized-LLMs-with-Dramatically-Lower-Inference-Cost) (2026-02-24)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-02-26/inception-labs-lanca-mercury-2-primeiro-modelo-de-raciocinio-baseado-em-difusao
