Anthropic lança Claude Haiku 5.5 com foco em custo e velocidade
A Anthropic lançou o Claude Haiku 5.5, que, segundo a empresa, custa em média 75% menos que o Haiku 4.5 e já está disponível via API na AWS, Google Cloud e Microsoft Azure.
Pontos principais
- Preço do Haiku 5.5: US$ 0,10 por milhão de tokens de entrada e US$ 0,50 de saída em prompts de até 100 mil tokens; o Haiku 4.5 custava US$ 1,00 e US$ 5,00.
- Acima de 100 mil tokens de prompt, o preço cai para US$ 0,50 de entrada e US$ 2,50 de saída, metade do valor do Haiku 4.5.
- Segundo a Anthropic, o custo médio de execução é cerca de 75% menor que o do Haiku 4.5, já descontado o tokenizador novo, que usa um pouco mais de tokens por tarefa.
- Benchmarks divulgados pela Anthropic: OSWorld 2.1 (subconjunto offline) com 72,4%, contra 15,7% do Haiku 4.5; Humanity's Last Exam sem ferramentas com 45,9%, contra 10,2%.
- Terminal-Bench 4.0: 39,2%, contra 0% do Haiku 4.5. No GDPval-AA v2.1, o modelo marca 1.620 de Elo, contra 735.
- A Asana relata latência até 30% menor na conclusão de tarefas e inferência até 2,5 vezes mais rápida por turno de agente, em relação ao modelo que usa hoje.
- Primeiro modelo da linha Haiku com ajuste de esforço, que permite escolher entre economia e capacidade de raciocínio.
- Sonnet 5.5: preço de leitura de cache reduzido pela metade, de US$ 0,20 para US$ 0,10 por milhão de tokens, o que a empresa estima em cerca de 20% de economia na maioria das tarefas agênticas.
- Créditos mensais de API: US$ 100 para o Max 5x, US$ 200 para o Max 20x e até US$ 500 para o Team, compartilhados entre os usuários da equipe. A liberação começa nesta semana.
A Anthropic lançou o Claude Haiku 5.5, que a empresa apresenta como o modelo pequeno mais barato, mais rápido e mais capaz que já lançou. Ele é voltado a tarefas de alto volume e sensíveis a custo, como resumos, compactação de contexto, consultas a bancos de dados e classificação, e pode atuar como subagente ao lado do Opus 5.5 e do Sonnet 5.5 em trabalhos de programação.
A empresa é explícita sobre o limite do modelo: em tarefas agênticas complexas de programação, o Sonnet 5.5 e o Opus 5.5 continuam sendo as escolhas melhores, e o Haiku 5.5 fica com trabalhos mais restritos, como compactação, sumarização e subagentes. A velocidade vale para o modo padrão, já que os modelos Opus são mais rápidos no Fast Mode.
A empresa também mexeu nos preços do Sonnet 5.5 e nos planos de assinatura, com o objetivo de incentivar a construção de ferramentas, aplicativos e agentes que chamam a API. O Haiku 5.5 já está disponível na Claude Platform com o identificador claude-haiku-5-5.
Tópicos relacionados
Cobertura da mídia
Comentários
Carregando comentários...
