---
title: "GPT-6 Astra lidera benchmarks de IA com alta performance no ARC-AGI-3"
url: https://dailyjournal.news/news/2026-09-03/gpt-6-astra-supera-concorrentes-em-benchmark-de-agi
published: 2026-09-03T20:45:36.51002+00:00
updated: 2026-09-03T21:40:41.896+00:00
categories: ["technology"]
source_count: 2
outlet_count: 1
language: pt-BR
publisher: "Daily Journal"
---

# GPT-6 Astra lidera benchmarks de IA com alta performance no ARC-AGI-3

O modelo GPT-6 Astra superou concorrentes no benchmark ARC-AGI-3, atingindo até 99,9% de precisão com novos métodos de adaptação.

## Pontos principais

- O GPT-6 Astra registrou 62,7% de desempenho no ARC-AGI-3 com o harness padrão.
- Com um novo harness de adaptador de provedor, o modelo alcançou 99,9% de pontuação.
- O modelo superou significativamente o Claude Opus 5, que pontuou 30,2%, e o GPT-5.6 Sol, com 7,8%.
- Em testes no benchmark WANDR, o GPT-6 Astra obteve a pontuação de 0,682 com custo de US$ 11,98 por tarefa.

O modelo de linguagem GPT-6 Astra demonstrou um salto expressivo de desempenho em avaliações técnicas recentes, consolidando sua posição no mercado de inteligência artificial. No benchmark ARC-AGI-3, o modelo atingiu 62,7% de precisão utilizando o harness padrão e elevou sua performance para 99,9% ao operar com um novo harness de adaptador de provedor. Esses resultados superam amplamente os índices obtidos pelo Claude Opus 5, que registrou 30,2%, e pelo GPT-5.6 Sol, que marcou 7,8%.

Além do sucesso no ARC-AGI-3, o GPT-6 Astra também liderou o benchmark WANDR com uma pontuação de 0,682, mantendo um custo operacional de US$ 11,98 por tarefa. A capacidade do modelo em equilibrar eficiência de processamento e custo reforça o avanço tecnológico na arquitetura de LLMs, superando concorrentes diretos em métricas de eficiência e precisão lógica.

## Fontes

- [@perplexity_ai: We evaluated GPT-6 Astra on WANDR. It scored 0.682 at $11.98 per task, the highest score of any model we tested.](https://x.com/perplexity_ai/status/2095620419906830788) (2026-09-03)
- [GPT-6 Astra scores 62.7% on ARC-AGI-3 with the standard harness and 99.9% with a new provider adapter harness; Claude Opus 5 scored 30.2%, and GPT-5.6 Sol 7.8% (Greg Kamradt/ARC Prize)](https://www.techmeme.com/260903/p40#a260903p40) — Techmeme (2026-09-03)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-09-03/gpt-6-astra-supera-concorrentes-em-benchmark-de-agi
