A Anthropic anunciou em 6 de outubro de 2026 a expansão do Cyber Verification Program (CVP), permitindo que entidades de segurança qualificadas utilizem capacidades cibernéticas avançadas e barreiras de classificação menos restritivas de acordo com a natureza de seu trabalho. O programa inclui os modelos Claude Opus 5.5, Claude Sonnet 5.5 e Claude Mythos 5.1, além de modelos futuros.
Três níveis de acordo com o tipo de trabalho
O programa começa com o nível Defense Access, destinado a operações defensivas, como tarefas de centros de operações de segurança e resposta a incidentes, engenharia reversa de malware e análise e verificação de vulnerabilidades. Entre as entidades potenciais estão equipes de segurança de empresas, universidades e órgãos governamentais, operadores de infraestrutura crítica, empresas de segurança menores, mantenedores de projetos de código aberto e pesquisadores individuais com histórico comprovado de comunicação de vulnerabilidades. A Anthropic espera responder às solicitações dentro de alguns dias.
Já o Red Team Access acrescenta testes de intrusão e equipes de simulação ofensiva, desde que os testes se limitem a sistemas que os solicitantes estejam autorizados a testar. Procedimentos como distribuir ransomware, danificar sistemas físicos ou testar sistemas de segurança de alto risco continuam momentaneamente proibidos. Atualmente, esse nível é limitado a instituições, e sua análise pode levar semanas, com os solicitantes qualificados sendo temporariamente incluídos no nível Defense Access.
O Specialized Access é reservado a um número limitado de instituições verificadas autorizadas a testar sistemas cuja interrupção possa afetar a vida das pessoas ou os mercados, como sistemas de operação de aeronaves, redes elétricas e de telecomunicações, infraestrutura de transferências entre bancos e redes governamentais. A Anthropic analisa cada instituição nesse nível em colaboração com o governo dos Estados Unidos. Os membros atuais do Project Glasswing também passarão para o novo nível sem uma nova certificação para os modelos atuais.
Testando o equilíbrio entre utilidade e bloqueio
A Anthropic testou o modelo Claude Opus 5.5 por meio do CyScenarioBench, uma avaliação que mede o planejamento e a execução de operações cibernéticas em várias etapas em condições realistas. Sem acesso ao CVP, todas as dez tarefas foram bloqueadas na primeira tentativa. No Defense Access, 46 de 50 tentativas foram bloqueadas em algum momento, enquanto quatro tentativas foram bem-sucedidas. No Red Team Access, não houve nenhum bloqueio, e o modelo concluiu 34 de 50 tarefas, praticamente o mesmo resultado registrado quando operado sem barreiras de proteção, com uma taxa de sucesso de 67,6%.
O que muda na prática?
A principal mudança não é abrir as capacidades cibernéticas para todos, mas separá-las dos modelos disponíveis ao público em geral por meio de uma verificação em vários níveis que vincula a potência do modelo ao tipo de autorização e aos controles necessários. Os modelos gerais continuam adequados para revisar código, corrigir problemas conhecidos, encontrar vulnerabilidades em código próprio e classificar alertas de segurança.
A Anthropic afirma que os parceiros do Project Glasswing descobriram pelo menos 129 mil vulnerabilidades de software documentadas entre abril e julho de 2026, enquanto as operações de varredura de código aberto realizadas pela empresa encontraram 5.500 vulnerabilidades adicionais entre abril e outubro. Mais de 33 mil delas foram classificadas até agora como críticas ou de alto risco, com a empresa alertando que os números podem estar abaixo da realidade porque dependem parcialmente de dados de varredura de uma amostra de parceiros.
A adesão ao programa exige a retenção de dados para monitorar o uso indevido cibernético. A Anthropic afirma que as instituições qualificadas poderão posteriormente usar o Enterprise Frontier Safeguards, que combina retenção zero de dados com controles de proteção e armazenamento de dados em uma infraestrutura de nuvem controlada pela instituição. Até que ele esteja disponível, alguns usuários do Claude Fable 5.1 ou Claude Mythos 5.1 com retenção zero poderão usar o CVP sob essa política.
Leitura da certi.news: o programa reflete uma tentativa prática de resolver o dilema do uso duplo em modelos de inteligência artificial: impedir o uso ofensivo generalizado sem privar as equipes de defesa de ferramentas que podem acelerar a descoberta de vulnerabilidades. No entanto, os resultados dos testes foram divulgados pela própria Anthropic, e a transição para níveis de acesso mais altos exige verificação institucional e supervisão contínua, enquanto o momento de disponibilização do EFS e o mecanismo detalhado de avaliação da elegibilidade continuam sendo pontos em aberto.