Pular para o conteúdo
    Notícia

    Claude 3.5 Sonnet une alto desempenho e menor custo em inteligência artificial

    Entenda o que é o Claude 3.5 Sonnet, suas melhorias de velocidade e custo frente ao Claude 3 Opus e os resultados dos principais testes técnicos.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    28 de set. de 2026 · 4 min de leitura

    Mesa de trabalho em escritório contemporâneo com monitores exibindo métricas visuais desfocadas, teclado e iluminação natural suave.
    Avanços na eficiência de modelos de ponta impulsionam novas abordagens em custos e produtividade na área técnica.

    O avanço das ferramentas de inteligência artificial costuma exigir um equilíbrio difícil: modelos mais inteligentes tendem a ser mais lentos e consideravelmente mais caros. A apresentação do Claude 3.5 Sonnet (abre em nova aba) mudou essa dinâmica no mercado. Lançado inicialmente em junho de 2024 e atualizado em outubro do mesmo ano, o modelo posicionou uma solução de categoria intermediária em um patamar de eficiência técnica que supera sistemas de maior porte.

    Para compreender o impacto dessa novidade, vale observar como os modelos de linguagem funcionam no dia a dia, quais marcas atingiram nos testes padronizados e como a linha de produtos da desenvolvedora está estruturada.

    O que é o Claude 3.5 Sonnet e por que ele importa

    O Claude 3.5 Sonnet é um modelo de linguagem de grande escala projetado para ler, interpretar e gerar texto e código. Em termos simples, ele funciona como um assistente virtual altamente treinado, capaz de entender instruções complexas, nuances de linguagem e regras lógicas.

    Tradicionalmente, a família Claude divide seus modelos em três faixas de capacidade e custo: Haiku, voltado para tarefas rápidas e econômicas; Sonnet, a opção intermediária de equilíbrio; e Opus, o modelo mais pesado e avançado. A grande novidade do Claude 3.5 Sonnet é que ele conseguiu superar o Claude 3 Opus em avaliações de conhecimento e raciocínio, mantendo o preço acessível e a agilidade da faixa intermediária.

    Profissional utilizando computador portátil em mesa de trabalho de madeira clara com iluminação natural suave e foco nas mãos sobre o teclado.
    Avanço em modelos intermediários viabiliza tarefas complexas em computadores portáteis do dia a dia, com menor custo computacional.

    Como o modelo funciona: velocidade, tokens e custos

    Para mensurar o uso de uma inteligência artificial, a indústria utiliza o conceito de token. Um token pode ser compreendido como um pedaço de palavra ou sílaba que o computador processa. Quando você envia uma pergunta, o sistema calcula os tokens de entrada; quando ele responde, gera tokens de saída.

    O Claude 3.5 Sonnet opera com uma janela de contexto de 200 mil tokens, o que representa a quantidade de informação textual que ele consegue analisar de uma só vez, equivalente a centenas de páginas de documentos.

    Em termos de velocidade e economia, o modelo apresenta vantagens nítidas sobre as versões anteriores:

    • Velocidade dobrada: o sistema opera com o dobro da velocidade do Claude 3 Opus. Em medições de transferência, alcança cerca de 100 tokens por segundo, enquanto o Claude 3 Sonnet anterior registrava aproximadamente 42 tokens por segundo.
    • Custo reduzido por tarefa: o acesso via interface de programação custa 3 dólares por milhão de tokens de entrada e 15 dólares por milhão de tokens de saída. O usuário obtém uma capacidade superior à do antigo modelo Opus pagando os valores da faixa intermediária.
    • Acesso diversificado: além de estar disponível gratuitamente na web e no aplicativo móvel oficial, o modelo foi integrado a serviços de nuvem e planos por assinatura.

    Desempenho técnico frente ao Claude 3 Opus

    Os testes padronizados, conhecidos no meio técnico como benchmarks, funcionam como exames vestibulares ou provas acadêmicas para computadores. Eles medem o conhecimento em áreas específicas com notas percentuais.

    Em avaliações internas de programação autônoma, em que o sistema resolve problemas de software sem intervenção humana constante, o Claude 3.5 Sonnet solucionou 64% dos desafios propostos, enquanto o Claude 3 Opus resolveu 38%.

    Teste técnico avaliadoO que a prova medePontuação registrada
    GPQARaciocínio lógico em nível de pós-graduação59,4% a 67,2% (55,3% a 60% no recorte Diamond)
    MMLUConhecimento multidisciplinar de graduação88,3% a 90,4%
    HumanEvalEficiência e correção em escrita de código89,9% a 93,7%
    SWE-bench VerifiedResolução de problemas reais de engenharia33,4% (inicial) e 49,0% (modelo atualizado)

    Registros técnicos independentes apontam pequenas variações nesses índices dependendo da data e do método de avaliação, com datas de divulgação variando entre 20 de junho e 22 de outubro de 2024. Vale destacar que testes como o SWE-bench Verified superaram outros sistemas especializados do mercado, incluindo o OpenAI o1-preview. Em tarefas de uso de ferramentas no setor de aviação dentro do teste TAU-bench, o modelo atualizado saltou de 36,0% para 46,0%.

    Cronograma e próximos passos da família Claude

    O lançamento do Claude 3.5 Sonnet marcou a estreia oficial da geração 3.5. Em outubro de 2024, a desenvolvedora apresentou a versão aprimorada do modelo, que incluiu o recurso experimental de controle de computador em fase preliminar, juntamente com a chegada do Claude 3.5 Haiku (abre em nova aba), voltado para operações mais velozes.

    Quanto ao modelo topo de linha, o Claude 3.5 Opus, a empresa comunicou que ele faz parte do planejamento da família de tecnologias, embora datas exatas de disponibilidade não tenham sido detalhadas nos comunicados iniciais. A evolução da linha demonstra que a eficiência operacional e a redução de custos tornaram-se prioridades tão relevantes quanto o ganho de inteligência pura no setor.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    Ver perfil completo