Claude Opus 5.5 atinge pontuação recorde em índice de IA
O modelo Claude Opus 5.5 alcançou 58 pontos no Intelligence Index da Artificial Analysis, marcando um avanço significativo em um ano.
Pontos principais
- A pontuação máxima no Intelligence Index subiu de 17, registrada pelo GPT-5 mini há um ano, para 58 com o Claude Opus 5.5.
- O Claude Opus 5.5, lançado em setembro de 2026, apresenta um custo operacional de aproximadamente US$ 5,98 por tarefa.
- O Intelligence Index avalia modelos em dez categorias, incluindo raciocínio, programação, matemática e ciências.
- O modelo da Anthropic também lidera o Epoch Capabilities Index, superando o GPT-6 Astra com uma pontuação de 167.
- O GPT-6.1 Sol, da OpenAI, detém atualmente a liderança no benchmark MathArena, com 90,1% de desempenho esperado.
O desempenho dos modelos de inteligência artificial apresentou uma evolução expressiva nos últimos 18 meses, conforme apontam os dados mais recentes da Artificial Analysis. O Claude Opus 5.5, lançado pela Anthropic em 22 de setembro de 2026, atingiu a marca recorde de 58 pontos no Intelligence Index, um salto considerável em relação aos 17 pontos registrados pelo GPT-5 mini há cerca de um ano. Esse progresso reflete mudanças na fronteira de eficiência e custo, com o modelo atual operando a um custo de US$ 5,98 por tarefa.
Além do Intelligence Index, o cenário de benchmarks de IA mostra uma disputa acirrada entre as principais desenvolvedoras. Enquanto o Claude Opus 5.5 também ocupa o topo do Epoch Capabilities Index, com 167 pontos, o GPT-6.1 Sol da OpenAI consolidou sua liderança no MathArena, focado em competências matemáticas. O Intelligence Index, que compila avaliações como o Humanity's Last Exam e o Terminal-Bench, serve como uma métrica composta para medir o progresso rumo à inteligência artificial geral.
Comentários
Carregando comentários...
