A Anthropic (abre em nova aba) anunciou, em 6 de outubro de 2026, uma versão ampliada do Cyber Verification Program, o CVP. O programa dá a profissionais de segurança verificados acesso aos modelos de IA mais capazes da empresa, entre eles Claude Opus 5.5, Claude Sonnet 5.5 e Claude Mythos 5.1, com menos bloqueios automáticos para tarefas de cibersegurança.
Para entender o que mudou, ajuda saber como as coisas funcionavam. Modelos de IA como o Claude têm filtros de segurança que interrompem certos usos, por exemplo análise de malware ou validação de falhas de software, justamente porque as mesmas técnicas podem servir para atacar sistemas. Nos últimos seis meses, a Anthropic administrou dois programas separados de exceção a esses filtros: o Project Glasswing, que dava o modelo Claude Mythos a organizações que protegem softwares críticos, e o CVP original, que afrouxava salvaguardas nos modelos Opus e Sonnet para equipes de segurança aprovadas. Agora os dois viraram um programa só, com três níveis de acesso.
Três portas de entrada
Cada nível libera um tipo de trabalho e tem seus próprios requisitos de verificação e controles de segurança, segundo a Anthropic.

| Nível | Para que serve | Quem pode se candidatar |
|---|---|---|
| Defense Access | Resposta a incidentes, engenharia reversa de malware, análise e validação de vulnerabilidades | Equipes de segurança de empresas, organizações sem fins lucrativos, universidades e governos; operadores de infraestrutura crítica de qualquer porte; pequenas firmas de segurança; mantenedores de código aberto; pesquisadores individuais com histórico de vulnerabilidades relatadas |
| Red Team Access | Tudo do nível anterior, mais testes de intrusão e simulações de ataque autorizadas | Equipes de ataque simulado internas e de governo, e firmas de teste de segurança |
| Specialized Access | Uso com menos bloqueios de todos, para testar sistemas sensíveis | Conjunto limitado de organizações verificadas e autorizadas a testar sistemas como malha aérea, redes elétricas, telecomunicações, transferências interbancárias e redes administrativas de governo |
Red Team Access, por exemplo, é o nome dado a simulações de ataque feitas com permissão, para encontrar falhas antes que criminosos as encontrem. O nível Specialized é o mais restrito justamente por tocar em infraestrutura cujo mau funcionamento causa dano real.
A candidatura é feita pelo portal de verificação (abre em nova aba), com um único formulário por organização. A Anthropic diz que encaixa o candidato no nível mais alto compatível com as informações recebidas e que pretende responder em poucos dias; a página de ajuda da empresa fala em notificação de decisão ou pedido de mais dados em até sete dias úteis.
Quem não participa do programa não fica sem opções. Os modelos disponíveis para o público continuam permitidos para revisão segura de código, modelagem de ameaças, correção de problemas conhecidos e triagem de alertas, mas trabalhos como análise de malware podem ser interrompidos pelos filtros.
Números do Glasswing
A expansão chega embalada por resultados do Project Glasswing. Segundo a Anthropic, parceiros da iniciativa confirmaram ao menos 129 mil vulnerabilidades de software verificadas entre abril e julho de 2026, e o próprio esforço de escaneamento de código aberto da empresa encontrou outras 5,5 mil entre abril e outubro. Dessas vulnerabilidades, mais de 33 mil foram classificadas até agora como críticas ou de alta severidade.
A própria empresa considera esses números conservadores. O levantamento se baseou em dados de apenas parte dos parceiros do Glasswing, e a Anthropic estima que o impacto real seja pelo menos cinco vezes maior. É uma estimativa, não um dado medido.
O que continua bloqueado
Reduzir filtros não significa liberar tudo. A Anthropic mantém bloqueios em tempo real para ações que poderiam causar dano físico ou interrupção em massa, como implantar ransomware, e o Red Team Access vale apenas para sistemas que a organização tem permissão para testar.
Em um teste divulgado pela empresa com a benchmark própria CyScenarioBench, que avalia operações de cibersegurança em múltiplas etapas, o Claude Opus 5.5 sem acesso ao CVP teve as 50 tentativas bloqueadas já no primeiro comando. Com o Defense Access, 46 foram bloqueadas em algum ponto e 4 foram concluídas.
O contexto pesa. A Reuters lembra que a apresentação do Claude Mythos Preview, em abril de 2026, levantou preocupações sobre a possibilidade de a IA explorar falhas de software antes que fossem corrigidas. Ao abrir mais a porta para pesquisa ofensiva autorizada, a Anthropic aposta que o benefício de encontrar falhas antes dos atacantes supera o risco de mau uso.
A empresa resumiu o espírito da mudança em sua conta oficial: profissionais verificados ganham "salvaguardas desenhadas para o trabalho defensivo", com novos níveis para "trabalho ofensivo autorizado, como testes de intrusão e red-teaming".
Estamos expandindo nosso Cyber Verification Program para dar aos profissionais de segurança acesso mais amplo aos nossos modelos mais capazes. Através deste programa, profissionais de segurança verificados podem acessar Claude Mythos 5.1, Opus 5.5 e Sonnet 5.5 com salvaguardas desenhadas para o trabalho defensivo. Também estamos abrindo novos níveis para permitir trabalho ofensivo autorizado, como testes de intrusão e red-teaming.
A Anthropic diz que novos modelos serão incorporados ao programa conforme forem lançados. Não foram divulgados, no anúncio, detalhes sobre o processo de auditoria das vulnerabilidades relatadas nem critérios completos de seleção do nível Specialized.

