A Anthropic reativou nesta quarta-feira, 1º de julho, o acesso global ao Claude Fable 5, seu modelo mais capaz disponível ao público. A reativação acontece depois que o governo dos Estados Unidos suspendeu os controles de exportação que haviam forçado a remoção do modelo em 12 de junho. Junto com a volta do Fable 5, a empresa também anunciou um novo classificador de segurança projetado especificamente para bloquear jailbreaks de cibersegurança.
A cronologia da suspensão
A Anthropic lançou o Fable 5 e o Mythos 5 — ambos baseados na mesma arquitetura — em 9 de junho. O Fable 5 é uma versão do modelo Mythos com salvaguardas reforçadas para uso geral, enquanto o Mythos 5 tem algumas proteções reduzidas para parceiros de cibersegurança defensiva.
Em 12 de junho, o governo americano impôs controles de exportação com efeito imediato, restringindo o acesso aos modelos para não-cidadãos americanos. Como a Anthropic não conseguia verificar a nacionalidade dos usuários em tempo real, suspendeu ambos os modelos para todos os usuários. O gatilho foi um relatório de pesquisadores da Amazon que encontraram uma técnica de jailbreak capaz de fazer o Fable 5 identificar vulnerabilidades de software e, em um caso, gerar código demonstrando como explorar uma delas.
Em 26 de junho, o governo aprovou a restauração do Mythos 5 para algumas organizações americanas. Em 30 de junho, os controles foram totalmente suspensos, abrindo caminho para a reativação global em 1º de julho.
O novo classificador de cibersegurança
Mesmo argumentando que a vulnerabilidade não era exclusiva do Fable 5 — modelos menos capazes como Claude Opus 4.8, GPT-5.5 e Kimi K2.7 identificaram as mesmas falhas — a Anthropic desenvolveu um novo classificador de segurança para o comportamento reportado.
O novo sistema bloqueia a técnica específica em mais de 99% dos casos. Quando o classificador é acionado, a requisição não é simplesmente recusada: ela é redirecionada para o Claude Opus 4.8, e o usuário é notificado do fallback. Esse design de “defesa em profundidade” — com classificadores menores atuando como detectores de tarefas maliciosas e uma margem de segurança deliberada que também bloqueia algumas requisições legítimas — é uma assinatura da abordagem da Anthropic à segurança de modelos.
Pesquisadores do CAISI (Department of Commerce) testaram tanto as salvaguardas antigas quanto as novas e concordaram que são “extraordinariamente fortes”. O lado negativo: mais falsos positivos durante tarefas rotineiras de codificação e debugging.
Um framework para classificar jailbreaks
O episódio expôs uma lacuna importante: a indústria não tem um padrão compartilhado para classificar a gravidade de um jailbreak. A Anthropic está liderando a criação de um framework em parceria com Amazon, Microsoft, Google e outros parceiros do consórcio Glasswing.
O draft avalia jailbreaks em quatro critérios: (1) se o comportamento é exclusivo do modelo ou comum a outros, (2) a criticidade da tarefa desbloqueada, (3) a facilidade de reprodução da técnica, e (4) se existem defesas conhecidas. Para a classe mais severa, a Anthropic se compromete a implantar mitigações preliminares imediatamente e está estabelecendo monitoramento 24/7 dos canais de submissão de jailbreaks.
Como o Fable 5 se compara aos rivais
A pausa de 19 dias criou uma janela para concorrentes. Dias após a suspensão, a Zhipu AI lançou o GLM-5.2 como pesos abertos, e testadores independentes o classificam como o modelo aberto mais forte disponível atualmente. Com design Mixture-of-Experts de ~750 bilhões de parâmetros totais (apenas ~40 bilhões ativos por token), o GLM-5.2 alcançou 39% de F1 no benchmark IDOR da Semgrep, superando o Claude Code com 32% na mesma tarefa.
A diferença de custo é ainda mais expressiva: no benchmark AA-Briefcase, o Fable 5 teve custo médio de US$ 31 por tarefa, contra US$ 2,40 do GLM-5.2 — uma diferença de quase 13x. Isso mostra que o mercado de modelos de fronteira está cada vez mais competitivo, com alternativas open-weight pressionando os preços para baixo.
Acesso e disponibilidade
Para planos Pro, Max, Team e Enterprise selecionados, o Fable 5 está incluído até 7 de julho, cobrindo até 50% dos limites semanais de uso. Depois disso, o acesso migra para créditos de uso. O modelo também está sendo reabilitado na AWS, Google Cloud e Microsoft Foundry. Desenvolvedores podem chamar o modelo com a string claude-fable-5 na API.
O que isso significa
A volta do Fable 5 é um sinal importante de que os mecanismos de controle de exportação de IA dos EUA estão evoluindo — de bloqueios totais para abordagens mais granulares baseadas em avaliação de risco. Ao mesmo tempo, a resposta rápida da Anthropic com um classificador específico e a proposta de um framework de severidade de jailbreaks mostra que a indústria está amadurecendo na forma como lida com riscos de segurança, indo além de correções pontuais para padrões compartilhados e monitoramento contínuo.
O episódio também deixa claro que a competição não espera: 19 dias foram suficientes para um concorrente open-weight desafiar a liderança do Fable 5 em benchmarks específicos e — mais importante — em custo por tarefa.
Descubra mais sobre noticiAI
Assine para receber nossas notícias mais recentes por e-mail.



