Pular para o conteúdo
    Notícia

    Anthropic amplia programa de segurança e abre Claude com menos bloqueios para equipes verificadas

    A Anthropic unificou o Cyber Verification Program e o Project Glasswing em três níveis de acesso aos modelos Claude, com salvaguardas reduzidas para trabalho defensivo e ofensivo autorizado. Parceiros do Glasswing já confirmaram ao menos 129 mil vulnerabilidades de software entre abril e julho de 2026.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    7 de out. de 2026 · 4 min de leitura

    Seguir no Google
    Fotografia editorial de um corredor estreito de datacenter com painéis metálicos escuros e cabos em calhas no teto; três portas blindadas de aço escovado em perspectiva decrescente, a mais distante fechada, a intermediária entreaberta com f
    Acesso em três níveis: corredor de datacenter com portas blindadas simboliza o novo modelo de verificação da Anthropic, que reduz bloqueios do Claude para equipes de segurança autorizadas.

    A Anthropic (abre em nova aba) anunciou, em 6 de outubro de 2026, uma versão ampliada do Cyber Verification Program, o CVP. O programa dá a profissionais de segurança verificados acesso aos modelos de IA mais capazes da empresa, entre eles Claude Opus 5.5, Claude Sonnet 5.5 e Claude Mythos 5.1, com menos bloqueios automáticos para tarefas de cibersegurança.

    Para entender o que mudou, ajuda saber como as coisas funcionavam. Modelos de IA como o Claude têm filtros de segurança que interrompem certos usos, por exemplo análise de malware ou validação de falhas de software, justamente porque as mesmas técnicas podem servir para atacar sistemas. Nos últimos seis meses, a Anthropic administrou dois programas separados de exceção a esses filtros: o Project Glasswing, que dava o modelo Claude Mythos a organizações que protegem softwares críticos, e o CVP original, que afrouxava salvaguardas nos modelos Opus e Sonnet para equipes de segurança aprovadas. Agora os dois viraram um programa só, com três níveis de acesso.

    Três portas de entrada

    Cada nível libera um tipo de trabalho e tem seus próprios requisitos de verificação e controles de segurança, segundo a Anthropic.

    Fotografia editorial em 16:9 de um corredor técnico de datacenter ao fim da tarde: uma engenheira de segurança de jaqueta escura segura com as duas mãos um crachá rígido junto ao peito, prestes a passá-lo num leitor de uma pesada porta cort
    Controle de acesso em três níveis: crachá verificado na entrada de área restrita de datacenter, eco visual do novo escalonamento de permissões que a Anthropic aplica aos modelos Claude para equipes de segurança.
    NívelPara que serveQuem pode se candidatar
    Defense AccessResposta a incidentes, engenharia reversa de malware, análise e validação de vulnerabilidadesEquipes de segurança de empresas, organizações sem fins lucrativos, universidades e governos; operadores de infraestrutura crítica de qualquer porte; pequenas firmas de segurança; mantenedores de código aberto; pesquisadores individuais com histórico de vulnerabilidades relatadas
    Red Team AccessTudo do nível anterior, mais testes de intrusão e simulações de ataque autorizadasEquipes de ataque simulado internas e de governo, e firmas de teste de segurança
    Specialized AccessUso com menos bloqueios de todos, para testar sistemas sensíveisConjunto limitado de organizações verificadas e autorizadas a testar sistemas como malha aérea, redes elétricas, telecomunicações, transferências interbancárias e redes administrativas de governo

    Red Team Access, por exemplo, é o nome dado a simulações de ataque feitas com permissão, para encontrar falhas antes que criminosos as encontrem. O nível Specialized é o mais restrito justamente por tocar em infraestrutura cujo mau funcionamento causa dano real.

    A candidatura é feita pelo portal de verificação (abre em nova aba), com um único formulário por organização. A Anthropic diz que encaixa o candidato no nível mais alto compatível com as informações recebidas e que pretende responder em poucos dias; a página de ajuda da empresa fala em notificação de decisão ou pedido de mais dados em até sete dias úteis.

    Quem não participa do programa não fica sem opções. Os modelos disponíveis para o público continuam permitidos para revisão segura de código, modelagem de ameaças, correção de problemas conhecidos e triagem de alertas, mas trabalhos como análise de malware podem ser interrompidos pelos filtros.

    Números do Glasswing

    A expansão chega embalada por resultados do Project Glasswing. Segundo a Anthropic, parceiros da iniciativa confirmaram ao menos 129 mil vulnerabilidades de software verificadas entre abril e julho de 2026, e o próprio esforço de escaneamento de código aberto da empresa encontrou outras 5,5 mil entre abril e outubro. Dessas vulnerabilidades, mais de 33 mil foram classificadas até agora como críticas ou de alta severidade.

    A própria empresa considera esses números conservadores. O levantamento se baseou em dados de apenas parte dos parceiros do Glasswing, e a Anthropic estima que o impacto real seja pelo menos cinco vezes maior. É uma estimativa, não um dado medido.

    O que continua bloqueado

    Reduzir filtros não significa liberar tudo. A Anthropic mantém bloqueios em tempo real para ações que poderiam causar dano físico ou interrupção em massa, como implantar ransomware, e o Red Team Access vale apenas para sistemas que a organização tem permissão para testar.

    Em um teste divulgado pela empresa com a benchmark própria CyScenarioBench, que avalia operações de cibersegurança em múltiplas etapas, o Claude Opus 5.5 sem acesso ao CVP teve as 50 tentativas bloqueadas já no primeiro comando. Com o Defense Access, 46 foram bloqueadas em algum ponto e 4 foram concluídas.

    O contexto pesa. A Reuters lembra que a apresentação do Claude Mythos Preview, em abril de 2026, levantou preocupações sobre a possibilidade de a IA explorar falhas de software antes que fossem corrigidas. Ao abrir mais a porta para pesquisa ofensiva autorizada, a Anthropic aposta que o benefício de encontrar falhas antes dos atacantes supera o risco de mau uso.

    A empresa resumiu o espírito da mudança em sua conta oficial: profissionais verificados ganham "salvaguardas desenhadas para o trabalho defensivo", com novos níveis para "trabalho ofensivo autorizado, como testes de intrusão e red-teaming".

    Estamos expandindo nosso Cyber Verification Program para dar aos profissionais de segurança acesso mais amplo aos nossos modelos mais capazes. Através deste programa, profissionais de segurança verificados podem acessar Claude Mythos 5.1, Opus 5.5 e Sonnet 5.5 com salvaguardas desenhadas para o trabalho defensivo. Também estamos abrindo novos níveis para permitir trabalho ofensivo autorizado, como testes de intrusão e red-teaming.

    — Anthropic (@AnthropicAI), 6 de out. de 2026, no X

    A Anthropic diz que novos modelos serão incorporados ao programa conforme forem lançados. Não foram divulgados, no anúncio, detalhes sobre o processo de auditoria das vulnerabilidades relatadas nem critérios completos de seleção do nível Specialized.

    Foto de Leandro Vieira

    Leandro Vieira

    CEO e founder | IA.com.br

    Ver perfil completo