20%: essa é a redução direta aplicada pela Anthropic nas tarifas básicas do Claude Opus 5.5 em relação ao seu antecessor direto, o Claude Opus 5, marcando a chegada do novo modelo de ponta da empresa com custos nominais menores para desenvolvedores e empresas. Disponibilizado em 22 de setembro de 2026, o sistema foi integrado imediatamente à interface de programação da companhia, ao ambiente Claude Code e aos catálogos em nuvem da AWS, Google Cloud e Microsoft Azure sob o identificador técnico claude-opus-5-5.
A cobrança de sistemas de inteligência artificial ocorre por pedaços de palavras ou caracteres processados, chamados de tokens. Para a entrada de dados, o valor estabelecido pela fornecedora ficou em US$ 4 por milhão de tokens, enquanto a geração de respostas sai por US$ 20 por milhão. Na versão Opus 5, essas mesmas etapas custavam US$ 5 e US$ 25, o que estabelece o abatimento linear de um quinto na tabela oficial.
O impacto orçamentário total, segundo a criadora da tecnologia, tende a ser mais acentuado do que a redução facial da tabela sugere. A empresa sustenta que a execução de uma tarefa completa pode sair cerca de 40% mais barata, pois o novo modelo precisaria de aproximadamente 20% menos tokens de entrada e de saída para concluir a mesma instrução. Quando uma pessoa contrata um serviço de frete, o total a pagar depende tanto do preço do quilômetro quanto do trajeto escolhido pelo motorista; se o condutor encontra um caminho mais curto e a tarifa do quilômetro também cai, a fatura final diminui por duas vias conjuntas.
| Operação na API | Claude Opus 5 | Claude Opus 5.5 | Variação percentual |
|---|---|---|---|
| Entrada padrão (1M tokens) | US$ 5,00 | US$ 4,00 | -20% |
| Saída padrão (1M tokens) | US$ 25,00 | US$ 20,00 | -20% |
| Leitura de memória temporária (cache) | US$ 0,50 | US$ 0,20 | -60% |
| Escrita em cache (5 minutos) | US$ 6,25 | US$ 5,00 | -20% |
| Processamento em lote (Batch entrada) | US$ 2,50 | US$ 2,00 | -20% |
| Processamento em lote (Batch saída) | US$ 12,50 | US$ 10,00 | -20% |
A leitura de dados em memória temporária rápida, conhecida no setor como cache, teve queda nominal de US$ 0,50 para US$ 0,20 por milhão de tokens. A gravação dessa memória por cinco minutos passou de US$ 6,25 para US$ 5,00, ao passo que a retenção por uma hora passou de US$ 10,00 para US$ 8,00. Para processamentos em lote com prazos flexíveis via chamada Batch, a tabela oficial da Anthropic (abre em nova aba) corta os valores padrão pela metade, fixando US$ 2 para entrada e US$ 10 para saída. Em contrapartida, aplicações que demandam velocidade prioritária contam com a opção rápida tabelada em US$ 8 por milhão na entrada e US$ 40 na saída.
No aspecto operacional, o modelo opera com uma janela de contexto de 1 milhão de tokens, permitindo ler volumes extensos de documentação em uma única interação, e suporta até 128 mil tokens em sua resposta gerada. A velocidade de produção de texto aumentou mais de 30% em relação ao Opus 5, refletindo no tempo de espera do usuário final.
O desempenho técnico divulgado pela criadora do sistema indica que o Opus 5.5 opera em nível semelhante ao Claude Fable 5.1 na maioria das atividades comuns de escritório. A maior distância prática entre eles surgiu nos testes de escrita e correção de código de computador, onde o modelo registrou seus melhores índices comparativos.
14,1 pontos percentuais foi a diferença registrada a favor do Opus 5.5 sobre o Opus 5 no teste Terminal-Bench 4.0, uma avaliação padronizada do setor que simula comandos de programação dentro de um terminal real de computador. O lançamento atingiu 66,4% de acerto nessa medição específica, enquanto o Fable 5.1 marcou 55,8% e o Opus 5 obteve 52,3%.
Esses números de eficiência e economia dependem das métricas internas fornecidas pela própria desenvolvedora, sem que relatórios de auditorias independentes tenham sido consolidados até o momento para confirmar se as tarefas do dia a dia gastam rotineiramente menos volume de texto em qualquer cenário corporativo.

