Inteligência artificial, sem ruído.
Modelos e LLMs4 min

Claude Sonnet 5: Anthropic lança seu modelo intermediário mais agentivo com benchmarks e preços competitivos

Anthropic lança Claude Sonnet 5 com benchmarks que batem o antecessor em todas as categorias. Preço introdutório de $2/$10 por MTok promete o melhor custo-benefício da linha.

Claude Sonnet 5: Anthropic lança seu modelo intermediário mais agentivo com benchmarks e preços competitivos

A Anthropic acaba de lançar o Claude Sonnet 5, o que a empresa descreve como seu modelo intermediário mais agentivo até agora. A novidade chega como sucessora do Sonnet 4.6 (fevereiro/2026) e fecha grande parte da distância que separava a linha Sonnet do carro-chefe Opus 4.8.

O que mudou no Sonnet 5

O Sonnet 5 já é o modelo padrão para os planos Free e Pro da Anthropic. Usuários dos planos Max, Team e Enterprise podem selecioná-lo manualmente. Ele também está disponível no Claude Code e na Claude Platform.

O foco desta versão não é um único benchmark, mas sim confiabilidade agentiva: cadeias de tarefas mais longas sem perda de contexto, melhor autocorreção quando uma chamada de ferramenta falha, e comportamento mais estável em sessões prolongadas dentro do Claude Code ou Cowork.

Uma mudança técnica relevante: o Sonnet 5 usa um tokenizer atualizado, o mesmo introduzido com o Opus 4.7. Na prática, o mesmo texto pode mapear para 1,0 a 1,35 vezes mais tokens, o que afeta diretamente o cálculo de custo.

Níveis de esforço: onde está o melhor custo-benefício

O modelo expõe quatro níveis de esforço: low, medium, high e xhigh (extra high). Níveis mais altos gastam mais tokens em raciocínio, aumentando tanto a qualidade quanto o custo.

O melhor valor aparece nos níveis low e medium, onde o Sonnet 5 entrega qualidade que o preço anterior da linha Sonnet não comprava. No nível xhigh, entretanto, ele pode custar mais que o Opus 4.8 para qualidade similar. Uma política prática de roteamento emerge daí: use o Sonnet 5 para a maioria das tarefas de codificação e uso de ferramentas, reserve o Opus 4.8 para trabalhos críticos de precisão.

ModeloPreço Input ($/MTok)Preço Output ($/MTok)
Sonnet 4.6$3$15
Sonnet 5 (intro)$2$10
Sonnet 5 (padrão)$3$15
Opus 4.8$5$25
Preços de API. O preço introdutório do Sonnet 5 é válido até 31 de agosto de 2026.

Benchmarks: vitória em todas as categorias contra o antecessor

BenchmarkSonnet 4.6Sonnet 5Opus 4.8
SWE-bench Pro (codificação agentiva)58,1%63,2%69,2%
Terminal-Bench 2.167,0%80,4%não reportado
OSWorld-Verified (computer use)78,5%81,2%não reportado
Humanity’s Last Exam (com ferramentas)46,8%57,4%57,9%
GDPval-AA v2 (trabalho de conhecimento)não reportado1.6181.615
Comparação de benchmarks. Dados do system card da Anthropic, 30 de junho de 2026.

O Sonnet 5 supera o 4.6 em todos os benchmarks publicados. No SWE-bench Pro (codificação agentiva), avança de 58,1% para 63,2%. No Terminal-Bench 2.1, o salto é ainda mais expressivo: de 67,0% para 80,4%.

No Humanity’s Last Exam com ferramentas, o Sonnet 5 atinge 57,4% — praticamente empata com o Opus 4.8 (57,9%). No benchmark de conhecimento GDPval-AA v2, o Sonnet 5 inclusive ultrapassa o Opus 4.8 por uma margem estreita (1.618 vs 1.615).

Casos de uso reais

Parceiros de acesso antecipado descreveram fluxos de trabalho concretos:

  • Engenharia de software multi-etapa: um testador pediu ao Sonnet 5 para investigar um bug. O modelo escreveu um teste de reprodução, implementou a correção e confirmou que o bug retornava sem a mudança — tudo em uma única passagem.
  • Debugging de código legado: outro parceiro executou o modelo em pull requests difíceis. O Sonnet 5 rastreou falhas até a causa raiz e entregou correções duráveis, não apenas remendos de sintoma.
  • Automação empresarial: o Zapier delegou uma tarefa de duas partes: atualizar níveis de conta no Salesforce e enviar um e-mail de lançamento para contatos enterprise. O modelo concluiu a tarefa ponta a ponta.
  • Agentes de computer use: a Pace executa fluxos de seguros — entrada de submissões e relatórios de sinistros — com agentes que atuam diretamente nos sistemas operacionais que as equipes já usam.
  • Exploração de dados: o ClickHouse usa agentes para consultar dados em tempo real e produzir insights instantâneos. Raciocínio mais rápido significa tempo até o insight reduzido para analistas.

Segurança

A Anthropic afirma que o Sonnet 5 é mais seguro que o 4.6, com capacidade cibernética deliberadamente baixa. Para trabalhos que exigem máxima precisão, o Opus 4.8 continua sendo a escolha recomendada.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.