Um modelo de IA que custa dez centavos de dólar por milhão de palavras processadas. Esse é o número que resume o Claude Haiku 5.5 (abre em nova aba), anunciado pela Anthropic (abre em nova aba) em 7 de outubro de 2026 e apresentado pela empresa como o menor, mais rápido e mais barato modelo já lançado por ela.
A data não é detalhe qualquer. Foi o terceiro lançamento da família Claude 5.5 em cerca de um mês, segundo a Reuters: o Claude Opus 5.5 saiu em 22 de setembro, o Claude Sonnet 5.5 em 28 de setembro e agora o Haiku 5.5 completa o trio, em um momento em que a empresa prepara uma oferta pública de ações (IPO, o lançamento de ações na bolsa). A agência de notças descreve o movimento como uma expansão do portfólio de inteligência artificial antes desse passo.
O que é o Haiku 5.5
Na prática, "Haiku" é o nome que a Anthropic dá aos seus modelos pequenos. Um modelo pequeno troca um pouco de capacidade de raciocínio por velocidade e preço baixo. Ele serve para tarefas repetitivas e de grande volume, em que não vale a pena pagar por um modelo grande.

Segundo a Anthropic, o Haiku 5.5 foi feito para trabalho de alto volume e sensível a custo: resumir documentos, consultar bancos de dados, classificar e extrair informações. Por ser o modelo mais rápido da família até agora, segundo a própria empresa, ele também serve para tarefas que não admitem demora, como atendimento ao cliente ao vivo, agentes de voz e assistentes dentro de aplicativos. A Reuters acrescenta que o modelo também atende suporte em tempo real e assistentes integrados em apps.
O modelo também trabalha em conjunto com os irmãos maiores. A Anthropic explica que ele pode atuar como "subagente" do Opus 5.5 e do Sonnet 5.5 em tarefas de programação: os modelos maiores dividem o trabalho e passam ao Haiku as etapas simples e repetitivas.
Preço e disponibilidade
Os números oficiais da Anthropic para o modelo, por milhão de tokens (a unidade que as IAs usam para medir texto):
| Item | Até 100 mil tokens | Acima de 100 mil tokens |
|---|---|---|
| Entrada | US$ 0,10 | US$ 0,50 |
| Saída | US$ 0,50 | US$ 2,50 |
Em média, segundo a empresa, rodar o Haiku 5.5 custa cerca de 75% menos do que rodar o Haiku 4.5, a versão anterior. É uma alegação da própria Anthropic, não uma medição independente, mas a diferença na tabela de preços é concreta: o modelo anterior cobrava US$ 1,00 por milhão de tokens de entrada e US$ 5,00 de saída, contra US$ 0,10 e US$ 0,50 do novo.
O modelo está disponível no site Claude.ai para usuários dos planos Free, Pro, Max, Team e Enterprise, em web, iOS e Android. Para quem cria aplicativos, ele pode ser usado na plataforma da própria Anthropic, no Amazon Bedrock (identificado como claude-haiku-5-5), no Google Cloud e no Microsoft Foundry. A documentação oficial indica janela de contexto de 1 milhão de tokens, saída máxima de 128 mil tokens e aposentadoria não antes de 7 de outubro de 2027.
A redução no Sonnet 5.5
Junto com o lançamento, a Anthropic fez outra mudança de preço, agora no modelo maior Claude Sonnet 5.5. O valor da leitura de cache caiu pela metade: de US$ 0,20 para US$ 0,10 por milhão de tokens.
Cache é uma memória temporária: quando um modelo lê as mesmas informações várias vezes em uma conversa ou tarefa longa, o cache guarda esse material para não processar tudo de novo. "Cache read", ou leitura de cache, é o ato de reaproveitar esse material guardado.
A economia parece pequena, mas não é. Segundo a Anthropic, as leituras de cache representam uma fatia grande do consumo de tokens de um modelo, e por isso a redução de 50% nesse item barateia o custo total do Sonnet 5.5 em cerca de 20% na maioria das tarefas com agentes. Agents, ou agentes, são IAs que executam várias etapas seguidas de um trabalho de forma autônoma, consultando ferramentas e informações no caminho.
Dois movimentos em um dia: um modelo pequeno que ficou muito mais barato e um modelo grande que ficou mais acessível para trabalhar em sequências longas. O número dez centavos que abriu esta notícia explica a estratégia.

