---
title: "Humanity's Last Exam publicado na Nature: melhores modelos acertam só 40-50%"
url: https://dailyjournal.news/news/2026-03-14/humanitys-last-exam-publicado-na-nature-melhores-modelos-acertam-so-40-50
published: 2026-03-14T12:00:00+00:00
categories: ["technology"]
source_count: 2
outlet_count: 0
language: pt-BR
publisher: "Daily Journal"
---

# Humanity's Last Exam publicado na Nature: melhores modelos acertam só 40-50%

Benchmark com 2.500 questões de quase mil especialistas de 50+ países mostra que Gemini 3.1 Pro e Claude Opus 4.6 ficam longe do nível humano.

## Pontos principais

- Quase mil especialistas de mais de 50 países criaram 2.500 questões em 100+ disciplinas
- GPT-4o acertou 2,7%, Claude 3.5 Sonnet 4,1%, o1 cerca de 8%
- Gemini 3.1 Pro e Claude Opus 4.6 alcançaram 40-50% de acerto
- Questões respondidas corretamente por IA existente foram removidas do exame
- Benchmark disponível publicamente em lastexam.ai

O Humanity's Last Exam, publicado na Nature, reúne 2.500 questões criadas por quase mil especialistas de mais de 50 países em mais de 100 disciplinas — matemática, humanidades, ciências naturais e línguas antigas. Qualquer questão respondida corretamente por modelos de IA no momento da criação foi removida, garantindo que o exame mede lacunas genuínas de capacidade.

Os resultados revelam um abismo entre competência comercial e expertise profunda: enquanto GPT-4o acertou apenas 2,7% e o1 cerca de 8%, os modelos mais recentes — Gemini 3.1 Pro e Claude Opus 4.6 — alcançaram 40-50%, ainda muito abaixo do desempenho humano especialista.

## Fontes

- [Benchmark de questões acadêmicas de nível especialista para avaliar capacidades de IA](https://www.nature.com/articles/s41586-025-09962-4) (2026-03-14)
- [Pesquisadores criam 'Último Exame da Humanidade' para testar limites da IA](https://thedebrief.org/researchers-create-humanitys-last-exam-to-test-the-limits-of-artificial-intelligence/) (2026-03-14)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-03-14/humanitys-last-exam-publicado-na-nature-melhores-modelos-acertam-so-40-50
