A Anthropic concluiu o lançamento do Claude Sonnet 5 e restaurou o acesso aos seus modelos de fronteira Fable 5 e Mythos 5, encerrando uma pausa operacional de dezoito dias imposta por uma diretiva federal de controle de exportação dos Estados Unidos.
A restrição, emitida em 12 de junho, foi motivada por pesquisadores da Amazon que documentaram um método para contornar os controles de segurança do Fable 5, fazendo com que o modelo identificasse vulnerabilidades de software e fornecesse código de exploração. A Anthropic desenvolveu um classificador de segurança automatizado que bloqueia o mecanismo de bypass em mais de 99% dos testes.
Vulnerabilidade não era exclusiva do Fable 5
As avaliações de segurança conduzidas durante a suspensão revelaram um dado preocupante: o comportamento de identificação de vulnerabilidades não era exclusivo do Fable 5. Arquiteturas mais antigas e menos capazes de múltiplos fornecedores — incluindo Claude Opus 4.8, GPT-5.5 e Kimi K2.7 — reproduziram exatamente os mesmos resultados. Isso indica que o problema é estrutural em modelos de fronteira, e não um bug específico de implementação.
Classificador com margem de segurança
O novo classificador opera com uma margem de segurança ampla, identificando e bloqueando prompts ambíguos que apresentem probabilidade estatística de intenção maliciosa. Quando um prompt aciona essa fronteira, a plataforma redireciona automaticamente a carga de trabalho para a arquitetura mais antiga Opus 4.8, mantendo a continuidade do serviço.
A contrapartida: a margem expandida introduz mais falsos positivos — o sistema sinaliza solicitações benignas com maior frequência durante o desenvolvimento rotineiro de aplicações e depuração de software.
Claude Sonnet 5: foco em agentes autônomos
Enquanto os modelos de fronteira enfrentam supervisão estatal rigorosa, o foco comercial imediato está no recém-lançado Claude Sonnet 5. Equipes de engenharia estão migrando agentes autônomos para este modelo, que executa planos de múltiplas etapas, opera terminais e navega em navegadores web sem intervenção humana — com custo operacional reduzido.
Métricas de desempenho e custo:
- Sonnet 5: SWE-bench Pro 63,2% | Terminal-Bench 2.1 80,4% | US$ 3,00/M input | US$ 15,00/M output
- Sonnet 4.6: SWE-bench Pro 58,1% | Terminal-Bench 2.1 67,0% | US$ 3,00/M input | US$ 15,00/M output
- Opus 4.8: SWE-bench Pro 69,2% | Terminal-Bench 2.1 82,7% | US$ 5,00/M input | US$ 25,00/M output
O Sonnet 5 tem preços introdutórios de US$ 2,00/M input e US$ 10,00/M output até 31 de agosto de 2026 — uma redução de 33% em relação ao preço padrão.
O que isso significa
O episódio expõe a tensão central da governança de IA: modelos de fronteira oferecem capacidades cada vez mais poderosas, mas também apresentam riscos de segurança que exigem controles regulatórios. A solução da Anthropic — um classificador automatizado em camada de software — é pragmática, mas os falsos positivos podem frustrar equipes de desenvolvimento.
Para o mercado, o Sonnet 5 representa uma opção com excelente relação custo-benefício para fluxos de trabalho agentivos, especialmente durante o período promocional. A retomada do Fable 5 e Mythos 5 também sinaliza que o governo americano considera as mitigações adequadas, pelo menos por enquanto.
Descubra mais sobre noticiAI
Assine para receber nossas notícias mais recentes por e-mail.



