Daily Journal
Daily Journal

Anthropic lança Claude Haiku 5.5 com foco em custo e velocidade

A Anthropic lançou o Claude Haiku 5.5, que, segundo a empresa, custa em média 75% menos que o Haiku 4.5 e já está disponível via API na AWS, Google Cloud e Microsoft Azure.

Daily Journal
Foto: Canaltech
||
08/10 às 08:31 · atualizado 14:29

Pontos principais

  • Preço do Haiku 5.5: US$ 0,10 por milhão de tokens de entrada e US$ 0,50 de saída em prompts de até 100 mil tokens; o Haiku 4.5 custava US$ 1,00 e US$ 5,00.
  • Acima de 100 mil tokens de prompt, o preço cai para US$ 0,50 de entrada e US$ 2,50 de saída, metade do valor do Haiku 4.5.
  • Segundo a Anthropic, o custo médio de execução é cerca de 75% menor que o do Haiku 4.5, já descontado o tokenizador novo, que usa um pouco mais de tokens por tarefa.
  • Benchmarks divulgados pela Anthropic: OSWorld 2.1 (subconjunto offline) com 72,4%, contra 15,7% do Haiku 4.5; Humanity's Last Exam sem ferramentas com 45,9%, contra 10,2%.
  • Terminal-Bench 4.0: 39,2%, contra 0% do Haiku 4.5. No GDPval-AA v2.1, o modelo marca 1.620 de Elo, contra 735.
  • A Asana relata latência até 30% menor na conclusão de tarefas e inferência até 2,5 vezes mais rápida por turno de agente, em relação ao modelo que usa hoje.
  • Primeiro modelo da linha Haiku com ajuste de esforço, que permite escolher entre economia e capacidade de raciocínio.
  • Sonnet 5.5: preço de leitura de cache reduzido pela metade, de US$ 0,20 para US$ 0,10 por milhão de tokens, o que a empresa estima em cerca de 20% de economia na maioria das tarefas agênticas.
  • Créditos mensais de API: US$ 100 para o Max 5x, US$ 200 para o Max 20x e até US$ 500 para o Team, compartilhados entre os usuários da equipe. A liberação começa nesta semana.

A Anthropic lançou o Claude Haiku 5.5, que a empresa apresenta como o modelo pequeno mais barato, mais rápido e mais capaz que já lançou. Ele é voltado a tarefas de alto volume e sensíveis a custo, como resumos, compactação de contexto, consultas a bancos de dados e classificação, e pode atuar como subagente ao lado do Opus 5.5 e do Sonnet 5.5 em trabalhos de programação.

A empresa é explícita sobre o limite do modelo: em tarefas agênticas complexas de programação, o Sonnet 5.5 e o Opus 5.5 continuam sendo as escolhas melhores, e o Haiku 5.5 fica com trabalhos mais restritos, como compactação, sumarização e subagentes. A velocidade vale para o modo padrão, já que os modelos Opus são mais rápidos no Fast Mode.

A empresa também mexeu nos preços do Sonnet 5.5 e nos planos de assinatura, com o objetivo de incentivar a construção de ferramentas, aplicativos e agentes que chamam a API. O Haiku 5.5 já está disponível na Claude Platform com o identificador claude-haiku-5-5.

Tópicos relacionados

Comentários

Carregando comentários...