Pular para o conteúdo
    Notícia

    Anthropic lança Claude Haiku 5.5 com queda de 75% no custo e corta pela metade preço de cache do Sonnet 5.5

    A Anthropic lançou em 7 de outubro de 2026 o Claude Haiku 5.5, menor e mais barato modelo da família Claude 5.5, e reduziu em 50% o preço de leitura de cache do Claude Sonnet 5.5, barateando tarefas com agentes.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    7 de out. de 2026 · 4 min de leitura

    Seguir no Google
    Fotografia macro de uma moeda de dez centavos de dólar em foco nítido sobre placa de metal grafite refletiva, posicionada no terço inferior direito do quadro; ao fundo, totalmente desfocado, corredor de infraestrutura de dados com feixes de
    Uma moeda de dez centavos diante de um corredor de infraestrutura de dados: o novo modelo Haiku 5.5 chega com queda de 75% no custo, enquanto a leitura de cache do Sonnet 5.5 fica 50% mais barata.

    Um modelo de IA que custa dez centavos de dólar por milhão de palavras processadas. Esse é o número que resume o Claude Haiku 5.5 (abre em nova aba), anunciado pela Anthropic (abre em nova aba) em 7 de outubro de 2026 e apresentado pela empresa como o menor, mais rápido e mais barato modelo já lançado por ela.

    A data não é detalhe qualquer. Foi o terceiro lançamento da família Claude 5.5 em cerca de um mês, segundo a Reuters: o Claude Opus 5.5 saiu em 22 de setembro, o Claude Sonnet 5.5 em 28 de setembro e agora o Haiku 5.5 completa o trio, em um momento em que a empresa prepara uma oferta pública de ações (IPO, o lançamento de ações na bolsa). A agência de notças descreve o movimento como uma expansão do portfólio de inteligência artificial antes desse passo.

    O que é o Haiku 5.5

    Na prática, "Haiku" é o nome que a Anthropic dá aos seus modelos pequenos. Um modelo pequeno troca um pouco de capacidade de raciocínio por velocidade e preço baixo. Ele serve para tarefas repetitivas e de grande volume, em que não vale a pena pagar por um modelo grande.

    Mãos com luvas de algodão depositam um pequeno tsuru de papel branco em uma longa fileira de pássaros idênticos sobre mesa de madeira clara, iluminada por luz dourada lateral de fim de tarde, com um único tsuru grande de papel metálico graf
    A produção em massa de modelos menores e mais baratos, como o novo Claude Haiku 5.5, convive com opções premium de dobras complexas — e a queda de 75% no custo promete acelerar tarefas repetitivas de agentes.

    Segundo a Anthropic, o Haiku 5.5 foi feito para trabalho de alto volume e sensível a custo: resumir documentos, consultar bancos de dados, classificar e extrair informações. Por ser o modelo mais rápido da família até agora, segundo a própria empresa, ele também serve para tarefas que não admitem demora, como atendimento ao cliente ao vivo, agentes de voz e assistentes dentro de aplicativos. A Reuters acrescenta que o modelo também atende suporte em tempo real e assistentes integrados em apps.

    O modelo também trabalha em conjunto com os irmãos maiores. A Anthropic explica que ele pode atuar como "subagente" do Opus 5.5 e do Sonnet 5.5 em tarefas de programação: os modelos maiores dividem o trabalho e passam ao Haiku as etapas simples e repetitivas.

    Preço e disponibilidade

    Os números oficiais da Anthropic para o modelo, por milhão de tokens (a unidade que as IAs usam para medir texto):

    ItemAté 100 mil tokensAcima de 100 mil tokens
    EntradaUS$ 0,10US$ 0,50
    SaídaUS$ 0,50US$ 2,50

    Em média, segundo a empresa, rodar o Haiku 5.5 custa cerca de 75% menos do que rodar o Haiku 4.5, a versão anterior. É uma alegação da própria Anthropic, não uma medição independente, mas a diferença na tabela de preços é concreta: o modelo anterior cobrava US$ 1,00 por milhão de tokens de entrada e US$ 5,00 de saída, contra US$ 0,10 e US$ 0,50 do novo.

    O modelo está disponível no site Claude.ai para usuários dos planos Free, Pro, Max, Team e Enterprise, em web, iOS e Android. Para quem cria aplicativos, ele pode ser usado na plataforma da própria Anthropic, no Amazon Bedrock (identificado como claude-haiku-5-5), no Google Cloud e no Microsoft Foundry. A documentação oficial indica janela de contexto de 1 milhão de tokens, saída máxima de 128 mil tokens e aposentadoria não antes de 7 de outubro de 2027.

    A redução no Sonnet 5.5

    Junto com o lançamento, a Anthropic fez outra mudança de preço, agora no modelo maior Claude Sonnet 5.5. O valor da leitura de cache caiu pela metade: de US$ 0,20 para US$ 0,10 por milhão de tokens.

    Cache é uma memória temporária: quando um modelo lê as mesmas informações várias vezes em uma conversa ou tarefa longa, o cache guarda esse material para não processar tudo de novo. "Cache read", ou leitura de cache, é o ato de reaproveitar esse material guardado.

    A economia parece pequena, mas não é. Segundo a Anthropic, as leituras de cache representam uma fatia grande do consumo de tokens de um modelo, e por isso a redução de 50% nesse item barateia o custo total do Sonnet 5.5 em cerca de 20% na maioria das tarefas com agentes. Agents, ou agentes, são IAs que executam várias etapas seguidas de um trabalho de forma autônoma, consultando ferramentas e informações no caminho.

    Dois movimentos em um dia: um modelo pequeno que ficou muito mais barato e um modelo grande que ficou mais acessível para trabalhar em sequências longas. O número dez centavos que abriu esta notícia explica a estratégia.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    Ver perfil completo