Pular para o conteúdo
    Notícia

    Anthropic lança Claude Haiku 5.5 com corte de até 90% no preço da API

    A Anthropic lançou o Claude Haiku 5.5 em 7 de outubro de 2026, com preço até 90% menor que o do Haiku 4.5 em solicitações curtas. O modelo supera o antecessor e o GPT-6 Luna em benchmarks divulgados pela própria empresa e já está disponível no Claude e nas principais nuvens.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    8 de out. de 2026 · 4 min de leitura

    Seguir no Google
    Centro de distribuição automatizado à noite com esteira transportadora em diagonal carregando um fluxo denso de caixas pequenas de papelão idênticas em alta velocidade, com rastros de movimento. Ao fundo, em baia desativada na sombra, uma e
    Lançamento do Claude Haiku 5.5 promete reduzir em até 90% o custo da API em solicitações curtas, acelerando a adoção em escala.

    A Anthropic anunciou em 7 de outubro de 2026 o Claude Haiku 5.5 (abre em nova aba), novo integrante da linha de modelos pequenos da família Claude. É o terceiro lançamento da geração 5.5 em cerca de um mês: o Opus 5.5 chegou em 22 de setembro, e o Haiku 5.5 completa agora o trio, como noticiou a Reuters. Segundo o veículo, a ampliação do catálogo ocorre antes de uma oferta pública inicial (IPO) planejada pela empresa.

    O modelo é voltado a tarefas de grande volume e sensíveis a custo: resumos, classificação de textos, consultas a bancos de dados e apoio a assistentes dentro de aplicativos, incluindo atendimento por voz. Na prática, o Haiku funciona como o modelo econômico da casa, e a Anthropic o posiciona também como auxiliar dos modelos maiores Opus 5.5 e Sonnet 5.5 em trabalhos de programação.

    No anúncio oficial, a empresa resumiu o lançamento assim:

    Apresentamos o Claude Haiku 5.5: o modelo pequeno mais barato, mais rápido e mais capaz que já lançamos. Em média, ele custa cerca de 75% menos para operar do que o Claude Haiku 4.5.

    — Claude (@claudeai), 7 de out. de 2026, no X

    Fotografia noturna em data center mostra corredor simétrico de armários de servidores altos desligados na penumbra azul-escura, contrastando com um único rack compacto aceso no primeiro plano, com dezenas de LEDs verdes e âmbar piscando, ve
    Lançado em outubro de 2026, o Claude Haiku 5.5 chega com preço até 90% menor que o antecessor em solicitações curtas, mantendo desempenho superior em benchmarks e disponibilidade imediata no Claude e nas principais nuvens.

    Quanto custa

    O preço de modelos de linguagem é cobrado por "token", que é um pedaço de palavra usado como unidade de medida do texto. Um milhão de tokens corresponde, aproximadamente, a centenas de páginas de conteúdo.

    A regra do novo preço vale para a maioria dos usos: em solicitações de até 100 mil tokens, o Haiku 5.5 é 90% mais barato que o Haiku 4.5. A exceção fica para textos longos: acima de 100 mil tokens, o desconto é de 50%. Segundo a Anthropic, cerca de 90% das requisições feitas ao Haiku 4.5 ficavam na faixa mais curta, e portanto na mais barata.

    Preço por milhão de tokensHaiku 4.5Haiku 5.5 (até 100 mil tokens)Haiku 5.5 (acima de 100 mil)
    EntradaUS$ 1,00US$ 0,10US$ 0,50
    SaídaUS$ 5,00US$ 0,50US$ 2,50

    Há um detalhe nessa conta. A economia média de 75% citada pela Anthropic não é um número exato de tabela: é uma estimativa da empresa, porque o novo modelo usa um "tokenizador" atualizado que consome ligeiramente mais tokens por tarefa. Ou seja, o preço por token cai mais do que o custo total, que depende de quantos tokens cada trabalho gasta.

    Quem usa cache, recurso que guarda partes repetidas de uma conversa para não processar tudo de novo, paga US$ 0,01 por milhão de tokens lidos no plano curto e US$ 0,05 no longo; a gravação no cache custa US$ 0,125 e US$ 0,625. A Anthropic também cortou pela metade a leitura de cache do Sonnet 5.5, de US$ 0,20 para US$ 0,10, o que, segundo a empresa, deixa a maioria dos trabalhos de agentes cerca de 20% mais barata.

    O que os números de desempenho mostram

    Os testes divulgados pela própria Anthropic colocam o Haiku 5.5 à frente do Haiku 4.5 e do GPT-6 Luna, da OpenAI, em várias comparações. No benchmark GDPval-AA v2.1, o modelo marcou 1.620 pontos, contra 735 do Haiku 4.5 e 1.437 do GPT-6 Luna. No OSWorld 2.1 (subconjunto offline), que avalia tarefas executadas em ambiente de computador, alcançou 72,4%, ante 15,7% e 48,9% dos rivais citados. Trata-se de números reportados pelo fornecedor, e não de auditoria independente.

    No Terminal-Bench 4.0, que mede o uso do terminal de comandos, o Haiku 5.5 atingiu 39,2%, mas com uma nuance: esse resultado corresponde ao esforço máximo. No esforço médio, que é o padrão, a pontuação fica em torno de 20%. É o primeiro Haiku com controle de esforço ajustável, recurso que permite gastar mais processamento apenas quando a tarefa exige.

    Clientes citados pela Anthropic relatam ganhos em produção. A AlphaSense faz cerca de 8 milhões de chamadas por semana ao modelo e obteve nota 0,84 em uma avaliação com 400 consultas, contra 0,76 do Haiku 4.5. A Box registrou resultado 11 pontos maior que o do modelo anterior, com cerca de metade da latência, ou seja, do tempo de resposta. A Asana relatou queda de mais de 30% na latência para concluir tarefas e inferência até 2,5 vezes mais rápida por turno de agente. Para quem processa milhões de chamadas por semana, a diferença de preço vira uma ajudinha e tanto no orçamento.

    Onde o modelo está disponível

    Usuários dos planos Free, Pro, Max, Team e Enterprise já podem escolher o Haiku 5.5 no Claude (abre em nova aba), na versão web e nos aplicativos para iOS e Android. Para desenvolvedores, o modelo está na plataforma da Anthropic, com o identificador claude-haiku-5-5, e também nas nuvens da Amazon Web Services, do Google e da Microsoft, além do Claude Code, ferramenta de programação da empresa.

    Segundo a Reuters, o Haiku 5.5 é o primeiro da linha com proteções internas para um conjunto restrito de pedidos de cibersegurança de alto risco. A Anthropic afirma que a maioria das tarefas cotidianas não é afetada por essas travas.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    Ver perfil completo