Daily Journal
Daily Journal

Claude Opus 5.5 atinge pontuação recorde em índice de IA

O modelo Claude Opus 5.5 alcançou 58 pontos no Intelligence Index da Artificial Analysis, marcando um avanço significativo em um ano.

Daily Journal
||
03/10 às 21:43

Pontos principais

  • A pontuação máxima no Intelligence Index subiu de 17, registrada pelo GPT-5 mini há um ano, para 58 com o Claude Opus 5.5.
  • O Claude Opus 5.5, lançado em setembro de 2026, apresenta um custo operacional de aproximadamente US$ 5,98 por tarefa.
  • O Intelligence Index avalia modelos em dez categorias, incluindo raciocínio, programação, matemática e ciências.
  • O modelo da Anthropic também lidera o Epoch Capabilities Index, superando o GPT-6 Astra com uma pontuação de 167.
  • O GPT-6.1 Sol, da OpenAI, detém atualmente a liderança no benchmark MathArena, com 90,1% de desempenho esperado.

O desempenho dos modelos de inteligência artificial apresentou uma evolução expressiva nos últimos 18 meses, conforme apontam os dados mais recentes da Artificial Analysis. O Claude Opus 5.5, lançado pela Anthropic em 22 de setembro de 2026, atingiu a marca recorde de 58 pontos no Intelligence Index, um salto considerável em relação aos 17 pontos registrados pelo GPT-5 mini há cerca de um ano. Esse progresso reflete mudanças na fronteira de eficiência e custo, com o modelo atual operando a um custo de US$ 5,98 por tarefa.

Além do Intelligence Index, o cenário de benchmarks de IA mostra uma disputa acirrada entre as principais desenvolvedoras. Enquanto o Claude Opus 5.5 também ocupa o topo do Epoch Capabilities Index, com 167 pontos, o GPT-6.1 Sol da OpenAI consolidou sua liderança no MathArena, focado em competências matemáticas. O Intelligence Index, que compila avaliações como o Humanity's Last Exam e o Terminal-Bench, serve como uma métrica composta para medir o progresso rumo à inteligência artificial geral.

Comentários

Carregando comentários...