Inteligência artificial, sem ruído.
Anthropic4 min

Anthropic reativa Claude Fable 5 após fim de controles de exportação e adiciona novo classificador de cibersegurança

Anthropic reativou o Claude Fable 5 globalmente em 1º de julho após a suspensão dos controles de exportação dos EUA. O modelo ganhou um novo classificador de segurança que bloqueia jailbreaks de cibersegurança em 99% dos casos. Empresa também propõe framework para classificar severidade de jailbreaks com Amazon, Microsoft e Google.

Anthropic reativa Claude Fable 5 após fim de controles de exportação e adiciona novo classificador de cibersegurança
Imagem de apoio. Fonte: MarkTechPost.

A Anthropic reativou nesta quarta-feira, 1º de julho, o acesso global ao Claude Fable 5, seu modelo mais capaz disponível ao público. A reativação acontece depois que o governo dos Estados Unidos suspendeu os controles de exportação que haviam forçado a remoção do modelo em 12 de junho. Junto com a volta do Fable 5, a empresa também anunciou um novo classificador de segurança projetado especificamente para bloquear jailbreaks de cibersegurança.

A cronologia da suspensão

A Anthropic lançou o Fable 5 e o Mythos 5 — ambos baseados na mesma arquitetura — em 9 de junho. O Fable 5 é uma versão do modelo Mythos com salvaguardas reforçadas para uso geral, enquanto o Mythos 5 tem algumas proteções reduzidas para parceiros de cibersegurança defensiva.

Em 12 de junho, o governo americano impôs controles de exportação com efeito imediato, restringindo o acesso aos modelos para não-cidadãos americanos. Como a Anthropic não conseguia verificar a nacionalidade dos usuários em tempo real, suspendeu ambos os modelos para todos os usuários. O gatilho foi um relatório de pesquisadores da Amazon que encontraram uma técnica de jailbreak capaz de fazer o Fable 5 identificar vulnerabilidades de software e, em um caso, gerar código demonstrando como explorar uma delas.

Em 26 de junho, o governo aprovou a restauração do Mythos 5 para algumas organizações americanas. Em 30 de junho, os controles foram totalmente suspensos, abrindo caminho para a reativação global em 1º de julho.

O novo classificador de cibersegurança

Mesmo argumentando que a vulnerabilidade não era exclusiva do Fable 5 — modelos menos capazes como Claude Opus 4.8, GPT-5.5 e Kimi K2.7 identificaram as mesmas falhas — a Anthropic desenvolveu um novo classificador de segurança para o comportamento reportado.

O novo sistema bloqueia a técnica específica em mais de 99% dos casos. Quando o classificador é acionado, a requisição não é simplesmente recusada: ela é redirecionada para o Claude Opus 4.8, e o usuário é notificado do fallback. Esse design de “defesa em profundidade” — com classificadores menores atuando como detectores de tarefas maliciosas e uma margem de segurança deliberada que também bloqueia algumas requisições legítimas — é uma assinatura da abordagem da Anthropic à segurança de modelos.

Pesquisadores do CAISI (Department of Commerce) testaram tanto as salvaguardas antigas quanto as novas e concordaram que são “extraordinariamente fortes”. O lado negativo: mais falsos positivos durante tarefas rotineiras de codificação e debugging.

Um framework para classificar jailbreaks

O episódio expôs uma lacuna importante: a indústria não tem um padrão compartilhado para classificar a gravidade de um jailbreak. A Anthropic está liderando a criação de um framework em parceria com Amazon, Microsoft, Google e outros parceiros do consórcio Glasswing.

O draft avalia jailbreaks em quatro critérios: (1) se o comportamento é exclusivo do modelo ou comum a outros, (2) a criticidade da tarefa desbloqueada, (3) a facilidade de reprodução da técnica, e (4) se existem defesas conhecidas. Para a classe mais severa, a Anthropic se compromete a implantar mitigações preliminares imediatamente e está estabelecendo monitoramento 24/7 dos canais de submissão de jailbreaks.

Como o Fable 5 se compara aos rivais

A pausa de 19 dias criou uma janela para concorrentes. Dias após a suspensão, a Zhipu AI lançou o GLM-5.2 como pesos abertos, e testadores independentes o classificam como o modelo aberto mais forte disponível atualmente. Com design Mixture-of-Experts de ~750 bilhões de parâmetros totais (apenas ~40 bilhões ativos por token), o GLM-5.2 alcançou 39% de F1 no benchmark IDOR da Semgrep, superando o Claude Code com 32% na mesma tarefa.

A diferença de custo é ainda mais expressiva: no benchmark AA-Briefcase, o Fable 5 teve custo médio de US$ 31 por tarefa, contra US$ 2,40 do GLM-5.2 — uma diferença de quase 13x. Isso mostra que o mercado de modelos de fronteira está cada vez mais competitivo, com alternativas open-weight pressionando os preços para baixo.

Acesso e disponibilidade

Para planos Pro, Max, Team e Enterprise selecionados, o Fable 5 está incluído até 7 de julho, cobrindo até 50% dos limites semanais de uso. Depois disso, o acesso migra para créditos de uso. O modelo também está sendo reabilitado na AWS, Google Cloud e Microsoft Foundry. Desenvolvedores podem chamar o modelo com a string claude-fable-5 na API.

O que isso significa

A volta do Fable 5 é um sinal importante de que os mecanismos de controle de exportação de IA dos EUA estão evoluindo — de bloqueios totais para abordagens mais granulares baseadas em avaliação de risco. Ao mesmo tempo, a resposta rápida da Anthropic com um classificador específico e a proposta de um framework de severidade de jailbreaks mostra que a indústria está amadurecendo na forma como lida com riscos de segurança, indo além de correções pontuais para padrões compartilhados e monitoramento contínuo.

O episódio também deixa claro que a competição não espera: 19 dias foram suficientes para um concorrente open-weight desafiar a liderança do Fable 5 em benchmarks específicos e — mais importante — em custo por tarefa.


Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.