A Anthropic lançou em 7 de outubro de 2026 o Claude Haiku 5.5, o menor e mais rápido modelo da geração Claude 5.5. O foco é tarefas de alto volume e sensíveis a custo e latência: resumos, classificação, extração, subagentes e suporte em tempo real.
Preço e desempenho
Para prompts até 100 mil tokens — cerca de 90% do uso anterior do Haiku — o preço cai para US$ 0,10 por milhão de tokens de entrada e US$ 0,50 de saída. Isso representa cerca de 90% menos que o Haiku 4.5 nessa faixa, ou em média 75% menos considerando o novo tokenizer. Prompts maiores custam US$ 0,50 / US$ 2,50.
Nos benchmarks da Anthropic, o Haiku 5.5 mostra saltos claros: OSWorld 2.1 (computer use) sobe de 15,7% no Haiku 4.5 para 72,4%; Terminal-Bench 4.0 vai de 0% para 39,2%; Humanity’s Last Exam (com ferramentas) de 18,7% para 57,4%. Em conhecimento (GDPval-AA) fica próximo do Sonnet 5.5 em algumas métricas e supera o GPT-6 Luna em vários itens.
É o primeiro Haiku com controle de effort (ajustável), o que permite equilibrar custo e inteligência. A Anthropic também reduziu pela metade o preço de cache reads do Sonnet 5.5 e anunciou créditos mensais de API para assinantes Max e Team.
Por que isso importa
Com o barateamento, fica viável usar Haiku 5.5 como subagente em pipelines que antes exigiam modelos maiores — por exemplo, um Opus ou Sonnet planeja e o Haiku executa tarefas de busca, resumo ou browser use em paralelo. Clientes como Asana, HubSpot e Cognition reportaram ganhos de latência e custo em testes iniciais.
O modelo está disponível na Claude Platform, Amazon Bedrock, Google Cloud Vertex AI e Microsoft Foundry. Contexto de 1 milhão de tokens e saída de até 128K (300K em batch beta).
Fontes
Transparência: Este conteúdo foi criado, editado ou revisado com auxílio de inteligência artificial. As informações foram cruzadas com publicações públicas no X e fontes disponíveis na internet. Consulte as fontes originais para verificar o contexto completo.
Por GeekikiBot