A Anthropic acaba de lançar o Claude Sonnet 5, o que a empresa descreve como seu modelo intermediário mais agentivo até agora. A novidade chega como sucessora do Sonnet 4.6 (fevereiro/2026) e fecha grande parte da distância que separava a linha Sonnet do carro-chefe Opus 4.8.
O que mudou no Sonnet 5
O Sonnet 5 já é o modelo padrão para os planos Free e Pro da Anthropic. Usuários dos planos Max, Team e Enterprise podem selecioná-lo manualmente. Ele também está disponível no Claude Code e na Claude Platform.
O foco desta versão não é um único benchmark, mas sim confiabilidade agentiva: cadeias de tarefas mais longas sem perda de contexto, melhor autocorreção quando uma chamada de ferramenta falha, e comportamento mais estável em sessões prolongadas dentro do Claude Code ou Cowork.
Uma mudança técnica relevante: o Sonnet 5 usa um tokenizer atualizado, o mesmo introduzido com o Opus 4.7. Na prática, o mesmo texto pode mapear para 1,0 a 1,35 vezes mais tokens, o que afeta diretamente o cálculo de custo.
Níveis de esforço: onde está o melhor custo-benefício
O modelo expõe quatro níveis de esforço: low, medium, high e xhigh (extra high). Níveis mais altos gastam mais tokens em raciocínio, aumentando tanto a qualidade quanto o custo.
O melhor valor aparece nos níveis low e medium, onde o Sonnet 5 entrega qualidade que o preço anterior da linha Sonnet não comprava. No nível xhigh, entretanto, ele pode custar mais que o Opus 4.8 para qualidade similar. Uma política prática de roteamento emerge daí: use o Sonnet 5 para a maioria das tarefas de codificação e uso de ferramentas, reserve o Opus 4.8 para trabalhos críticos de precisão.
| Modelo | Preço Input ($/MTok) | Preço Output ($/MTok) |
|---|---|---|
| Sonnet 4.6 | $3 | $15 |
| Sonnet 5 (intro) | $2 | $10 |
| Sonnet 5 (padrão) | $3 | $15 |
| Opus 4.8 | $5 | $25 |
Benchmarks: vitória em todas as categorias contra o antecessor
| Benchmark | Sonnet 4.6 | Sonnet 5 | Opus 4.8 |
|---|---|---|---|
| SWE-bench Pro (codificação agentiva) | 58,1% | 63,2% | 69,2% |
| Terminal-Bench 2.1 | 67,0% | 80,4% | não reportado |
| OSWorld-Verified (computer use) | 78,5% | 81,2% | não reportado |
| Humanity’s Last Exam (com ferramentas) | 46,8% | 57,4% | 57,9% |
| GDPval-AA v2 (trabalho de conhecimento) | não reportado | 1.618 | 1.615 |
O Sonnet 5 supera o 4.6 em todos os benchmarks publicados. No SWE-bench Pro (codificação agentiva), avança de 58,1% para 63,2%. No Terminal-Bench 2.1, o salto é ainda mais expressivo: de 67,0% para 80,4%.
No Humanity’s Last Exam com ferramentas, o Sonnet 5 atinge 57,4% — praticamente empata com o Opus 4.8 (57,9%). No benchmark de conhecimento GDPval-AA v2, o Sonnet 5 inclusive ultrapassa o Opus 4.8 por uma margem estreita (1.618 vs 1.615).
Casos de uso reais
Parceiros de acesso antecipado descreveram fluxos de trabalho concretos:
- Engenharia de software multi-etapa: um testador pediu ao Sonnet 5 para investigar um bug. O modelo escreveu um teste de reprodução, implementou a correção e confirmou que o bug retornava sem a mudança — tudo em uma única passagem.
- Debugging de código legado: outro parceiro executou o modelo em pull requests difíceis. O Sonnet 5 rastreou falhas até a causa raiz e entregou correções duráveis, não apenas remendos de sintoma.
- Automação empresarial: o Zapier delegou uma tarefa de duas partes: atualizar níveis de conta no Salesforce e enviar um e-mail de lançamento para contatos enterprise. O modelo concluiu a tarefa ponta a ponta.
- Agentes de computer use: a Pace executa fluxos de seguros — entrada de submissões e relatórios de sinistros — com agentes que atuam diretamente nos sistemas operacionais que as equipes já usam.
- Exploração de dados: o ClickHouse usa agentes para consultar dados em tempo real e produzir insights instantâneos. Raciocínio mais rápido significa tempo até o insight reduzido para analistas.
Segurança
A Anthropic afirma que o Sonnet 5 é mais seguro que o 4.6, com capacidade cibernética deliberadamente baixa. Para trabalhos que exigem máxima precisão, o Opus 4.8 continua sendo a escolha recomendada.
Descubra mais sobre noticiAI
Assine para receber nossas notícias mais recentes por e-mail.



