---
title: "OpenAI registra triplo de desempenho no benchmark ARC-AGI-3 com GPT-5.6"
url: https://dailyjournal.news/news/2026-07-30/openai-registra-triplo-de-desempenho-no-benchmark-arc-agi-3-com-gpt-56
published: 2026-07-30T10:31:54.812765+00:00
updated: 2026-07-30T12:32:39.941811+00:00
categories: ["technology"]
source_count: 5
outlet_count: 1
language: pt-BR
publisher: "Daily Journal"
---

# OpenAI registra triplo de desempenho no benchmark ARC-AGI-3 com GPT-5.6

Nova API de respostas da OpenAI eleva eficiência e performance do modelo GPT-5.6 Sol em testes de raciocínio complexo.

## Pontos principais

- O modelo GPT-5.6 Sol alcançou um desempenho três vezes superior no benchmark ARC-AGI-3 ao utilizar a nova API de respostas.
- A implementação demonstrou maior eficiência operacional, reduzindo o consumo de tokens durante a execução das tarefas.
- A OpenAI divulgou um vídeo comparativo que ilustra a capacidade aprimorada do modelo na resolução de problemas complexos.
- O benchmark ARC-AGI-3 é utilizado para medir a capacidade de raciocínio e generalização de sistemas de inteligência artificial.

A OpenAI anunciou um avanço significativo na performance de seu modelo GPT-5.6 Sol ao integrar uma nova API de respostas. Segundo a empresa, a atualização permitiu que o sistema triplicasse sua pontuação no benchmark ARC-AGI-3, um teste rigoroso focado na capacidade de raciocínio e abstração de modelos de linguagem. Além do ganho em precisão, a nova implementação otimizou o uso de recursos computacionais, exigindo um volume menor de tokens para processar as mesmas tarefas complexas. A melhoria reflete o esforço contínuo da companhia em elevar o patamar de eficiência de seus modelos de ponta. A empresa demonstrou os resultados por meio de um vídeo comparativo, evidenciando como a nova arquitetura de resposta supera as limitações observadas com o harness oficial, que anteriormente registrava um desempenho de 7,8% no mesmo teste.

## Fontes

- [Como ligar dois ajustes triplicou nossas notas no benchmark ARC-AGI-3](https://openai.com/index/how-two-settings-tripled-our-arc-agi-3-scores/) (2026-07-30)
- [OpenAI diz que nota do GPT-5.6 no ARC-AGI-3 triplicou após ligar dois ajustes de API](https://officechai.com/ai/openai-says-gpt-5-6s-score-on-arc-agi-3-tripled-after-turning-on-two-api-settings/) (2026-07-30)
- [OpenAI diz que GPT-5.6 Sol supera o Opus 5 no ARC-AGI-3 com dois ajustes de API](https://the-decoder.com/openai-claims-gpt-5-6-sol-beats-opus-5-on-arc-agi-3-with-its-latest-api-and-two-additional-settings/) (2026-07-30)
- [OpenAI says using its Responses API harness with GPT-5.6 Sol tripled its ARC-AGI-3 score and used fewer tokens, after Sol with the official harness scored 7.8% (OpenAI)](https://www.techmeme.com/260730/p11#a260730p11) — Techmeme (2026-07-30)
- [ARC Prize explica por que suas notas verificadas usam abordagem “sem harness”](https://x.com/arcprize/status/2082672003765670160) (2026-07-30)

---

Publicado por Daily Journal. Versão HTML: https://dailyjournal.news/news/2026-07-30/openai-registra-triplo-de-desempenho-no-benchmark-arc-agi-3-com-gpt-56
