Inteligência artificial, sem ruído.

Anthropic amplia acesso cibernético do Claude, mas impõe verificação e monitoramento

O Cyber Verification Program abre capacidades do Claude para defesa e red teaming autorizados. Entenda os níveis, os limites e a privacidade.

Anthropic amplia acesso cibernético do Claude, mas impõe verificação e monitoramento

A Anthropic anunciou em 5 de outubro de 2026 a expansão do Cyber Verification Program (CVP), programa que oferece a profissionais de segurança verificados acesso a capacidades cibernéticas mais amplas e a menos bloqueios automáticos em modelos Claude. A mudança reúne iniciativas anteriores em três níveis de acesso — Defense, Red Team e Specialized — e busca resolver uma tensão central da IA em segurança: a mesma capacidade que ajuda a corrigir falhas pode ser usada para explorá-las.

O que o programa muda

Os modelos de uso geral da Anthropic mantêm salvaguardas conservadoras para atividades cibernéticas. A empresa diz que isso limita abusos, mas reconhece que também pode bloquear trabalho legítimo de defesa, investigação de malware e validação de vulnerabilidades. O CVP cria uma rota de acesso diferenciada para organizações e profissionais que comprovem identidade, finalidade e controles de segurança.

Segundo a Anthropic, os três níveis incluem acesso aos modelos mais capazes, entre eles Claude Opus 5.5, Claude Sonnet 5.5 e Claude Mythos 5.1, além de modelos futuros. O programa está disponível na Claude Platform, Google Cloud Vertex AI e Microsoft Foundry; no Amazon Bedrock, a empresa condiciona a disponibilidade aos clientes elegíveis para Enterprise Frontier Safeguards.

Três níveis, três limites de risco

NívelFinalidade declaradaRestrições relevantes
Defense AccessSOC, resposta a incidentes, análise de malware e validação de vulnerabilidadesDestinado a quem defende sistemas próprios ou mantidos; a Anthropic espera responder em poucos dias
Red Team AccessTestes de intrusão e red teaming autorizadosApenas contra sistemas autorizados; bloqueios continuam para dano físico, interrupção em massa e sistemas de alto risco
Specialized AccessTestes de sistemas cuja falha pode afetar vidas ou mercadosReservado a poucas organizações verificadas e revisadas em profundidade com colaboração do governo dos EUA
Resumo das faixas de acesso anunciadas pela Anthropic.

O desenho reconhece que “segurança” não é uma permissão única. Investigar uma biblioteca sob controle do time de engenharia é diferente de testar uma rede de telecomunicações, uma malha elétrica ou infraestrutura de pagamentos. O valor do modelo de níveis está em ligar a ampliação de capacidade a um escopo verificável. Seu limite é inevitável: verificação, retenção de dados e revisão humana são processos que podem adicionar atrito e excluir pesquisadores individuais de atividades que exigem o nível mais alto.

O que os números do teste realmente mostram

A Anthropic usou o CyScenarioBench, uma avaliação de operações cibernéticas em múltiplas etapas, para comparar bloqueios entre as faixas. A empresa relata que, sem CVP, todas as tarefas foram bloqueadas já no primeiro prompt. No Defense Access, 46 de 50 tentativas foram bloqueadas em algum momento e quatro tiveram sucesso. No Red Team Access, não houve bloqueios e o Claude Opus 5.5 completou 34 de 50 tentativas, taxa equivalente aos 67,6% citados para o cenário sem salvaguardas, representativo do Specialized Access.

Esse resultado mostra que os classificadores de acesso alteram materialmente o comportamento do modelo. Não demonstra, por si só, que o programa elimina risco: a própria avaliação envolve cenários ofensivos e foi relatada pela empresa. A questão operacional é se a verificação de organizações, os controles de uso e a monitoração conseguem manter a capacidade no contexto autorizado ao longo do tempo.

Privacidade e monitoramento: a contrapartida do acesso

A Anthropic exige retenção de dados para participantes do programa, dizendo que precisa monitorar mau uso cibernético. Ela afirma que, quando o Enterprise Frontier Safeguards estiver disponível no fim do outono no hemisfério norte, organizações elegíveis poderão armazenar dados em infraestrutura de nuvem sob seu controle. Até lá, a companhia cita uma exceção para acesso a Claude Fable 5.1 ou Claude Mythos 5.1 com retenção zero de dados.

Para organizações brasileiras, esse detalhe importa tanto quanto a capacidade do modelo. Segurança não elimina obrigações de proteção de dados. Antes de enviar logs, código proprietário, amostras de malware ou evidências de incidente, é preciso mapear o que será retido, quem poderá acessar, qual jurisdição se aplica, por quanto tempo os dados ficam disponíveis e se o contrato atende à LGPD e às políticas internas.

O argumento de impacto apresentado pela Anthropic

A empresa atribui ao Project Glasswing e a parceiros a identificação de pelo menos 129 mil vulnerabilidades de software verificadas entre abril e julho de 2026. Em seus próprios esforços de varredura de código aberto, afirma ter localizado mais 5.500 vulnerabilidades entre abril e outubro, e diz que mais de 33 mil foram classificadas como críticas ou de alta severidade. A Anthropic ressalva que o primeiro número é baseado em dados de uma parcela dos parceiros e estima que o impacto real possa ser pelo menos cinco vezes maior.

São números expressivos, mas devem ser lidos como dados divulgados pela própria fornecedora, não como auditoria independente do programa. “Vulnerabilidade verificada” também não é sinônimo automático de falha corrigida, risco eliminado ou exposição equivalente: a prioridade de correção depende de explorabilidade, ativos afetados e contexto de cada organização.

Aplicação prática para equipes de segurança

  • Triagem de vulnerabilidades: transformar relatórios e código em hipóteses de correção, sempre com revisão técnica humana.
  • Resposta a incidentes: resumir evidências e apoiar análise de malware em ambientes isolados e autorizados.
  • Red teaming: acelerar testes contra ativos explicitamente incluídos no escopo contratual.
  • Segurança de software: procurar padrões de falha em bases próprias, com registro de decisões e proteção de segredos.

Em todos esses casos, a regra continua sendo autorização explícita. Um modelo com menos bloqueios não cria direito de testar sistemas de terceiros.

Análise do NoticIA

O CVP é uma tentativa relevante de sair da falsa escolha entre um assistente extremamente restrito e um modelo irrestrito. O desenho por níveis é mais próximo de como equipes de segurança já trabalham: escopo, credenciais, auditoria e responsabilidades diferentes conforme o impacto. A fragilidade do modelo está na execução. Se o processo de verificação for opaco ou lento, defensores continuarão bloqueados; se for frouxo, a expansão de capacidade amplia o risco de desvio. Para clientes, a decisão deve combinar teste técnico, contrato de dados e governança — e não apenas a promessa de menos recusas.

Como solicitar e o que validar antes

A Anthropic disponibiliza um formulário de inscrição para o CVP. Antes de aplicar, uma organização deve documentar os sistemas no escopo, controles de acesso, responsáveis, política de retenção, procedimento de reporte e revisão humana para ações que afetem produção. Esse preparo ajuda a demonstrar legitimidade e reduz o risco de transformar uma ferramenta de defesa em mais uma fonte de exposição.



Descubra mais sobre noticiAI

Assine para receber nossas notícias mais recentes por e-mail.

R
Sobre o autorRedação Noticiai

Equipe editorial dedicada a explicar inteligência artificial com clareza, independência e contexto.