A Anthropic anunciou em 7 de outubro de 2026 o Claude Haiku 5.5 (abre em nova aba), novo integrante da linha de modelos pequenos da família Claude. É o terceiro lançamento da geração 5.5 em cerca de um mês: o Opus 5.5 chegou em 22 de setembro, e o Haiku 5.5 completa agora o trio, como noticiou a Reuters. Segundo o veículo, a ampliação do catálogo ocorre antes de uma oferta pública inicial (IPO) planejada pela empresa.
O modelo é voltado a tarefas de grande volume e sensíveis a custo: resumos, classificação de textos, consultas a bancos de dados e apoio a assistentes dentro de aplicativos, incluindo atendimento por voz. Na prática, o Haiku funciona como o modelo econômico da casa, e a Anthropic o posiciona também como auxiliar dos modelos maiores Opus 5.5 e Sonnet 5.5 em trabalhos de programação.
No anúncio oficial, a empresa resumiu o lançamento assim:
Apresentamos o Claude Haiku 5.5: o modelo pequeno mais barato, mais rápido e mais capaz que já lançamos. Em média, ele custa cerca de 75% menos para operar do que o Claude Haiku 4.5.

Quanto custa
O preço de modelos de linguagem é cobrado por "token", que é um pedaço de palavra usado como unidade de medida do texto. Um milhão de tokens corresponde, aproximadamente, a centenas de páginas de conteúdo.
A regra do novo preço vale para a maioria dos usos: em solicitações de até 100 mil tokens, o Haiku 5.5 é 90% mais barato que o Haiku 4.5. A exceção fica para textos longos: acima de 100 mil tokens, o desconto é de 50%. Segundo a Anthropic, cerca de 90% das requisições feitas ao Haiku 4.5 ficavam na faixa mais curta, e portanto na mais barata.
| Preço por milhão de tokens | Haiku 4.5 | Haiku 5.5 (até 100 mil tokens) | Haiku 5.5 (acima de 100 mil) |
|---|---|---|---|
| Entrada | US$ 1,00 | US$ 0,10 | US$ 0,50 |
| Saída | US$ 5,00 | US$ 0,50 | US$ 2,50 |
Há um detalhe nessa conta. A economia média de 75% citada pela Anthropic não é um número exato de tabela: é uma estimativa da empresa, porque o novo modelo usa um "tokenizador" atualizado que consome ligeiramente mais tokens por tarefa. Ou seja, o preço por token cai mais do que o custo total, que depende de quantos tokens cada trabalho gasta.
Quem usa cache, recurso que guarda partes repetidas de uma conversa para não processar tudo de novo, paga US$ 0,01 por milhão de tokens lidos no plano curto e US$ 0,05 no longo; a gravação no cache custa US$ 0,125 e US$ 0,625. A Anthropic também cortou pela metade a leitura de cache do Sonnet 5.5, de US$ 0,20 para US$ 0,10, o que, segundo a empresa, deixa a maioria dos trabalhos de agentes cerca de 20% mais barata.
O que os números de desempenho mostram
Os testes divulgados pela própria Anthropic colocam o Haiku 5.5 à frente do Haiku 4.5 e do GPT-6 Luna, da OpenAI, em várias comparações. No benchmark GDPval-AA v2.1, o modelo marcou 1.620 pontos, contra 735 do Haiku 4.5 e 1.437 do GPT-6 Luna. No OSWorld 2.1 (subconjunto offline), que avalia tarefas executadas em ambiente de computador, alcançou 72,4%, ante 15,7% e 48,9% dos rivais citados. Trata-se de números reportados pelo fornecedor, e não de auditoria independente.
No Terminal-Bench 4.0, que mede o uso do terminal de comandos, o Haiku 5.5 atingiu 39,2%, mas com uma nuance: esse resultado corresponde ao esforço máximo. No esforço médio, que é o padrão, a pontuação fica em torno de 20%. É o primeiro Haiku com controle de esforço ajustável, recurso que permite gastar mais processamento apenas quando a tarefa exige.
Clientes citados pela Anthropic relatam ganhos em produção. A AlphaSense faz cerca de 8 milhões de chamadas por semana ao modelo e obteve nota 0,84 em uma avaliação com 400 consultas, contra 0,76 do Haiku 4.5. A Box registrou resultado 11 pontos maior que o do modelo anterior, com cerca de metade da latência, ou seja, do tempo de resposta. A Asana relatou queda de mais de 30% na latência para concluir tarefas e inferência até 2,5 vezes mais rápida por turno de agente. Para quem processa milhões de chamadas por semana, a diferença de preço vira uma ajudinha e tanto no orçamento.
Onde o modelo está disponível
Usuários dos planos Free, Pro, Max, Team e Enterprise já podem escolher o Haiku 5.5 no Claude (abre em nova aba), na versão web e nos aplicativos para iOS e Android. Para desenvolvedores, o modelo está na plataforma da Anthropic, com o identificador claude-haiku-5-5, e também nas nuvens da Amazon Web Services, do Google e da Microsoft, além do Claude Code, ferramenta de programação da empresa.
Segundo a Reuters, o Haiku 5.5 é o primeiro da linha com proteções internas para um conjunto restrito de pedidos de cibersegurança de alto risco. A Anthropic afirma que a maioria das tarefas cotidianas não é afetada por essas travas.

