Pular para o conteúdo
    Artigo

    O scanner gratuito da Anthropic acha falhas em código aberto sem revisão humana

    Análise do OSS Scanner, serviço gratuito da Anthropic que usa modelos de fronteira para auditar projetos de código aberto por adesão. O texto examina o funil do Project Glasswing, o formato dos relatórios, os números de validação divulgados e o que um mantenedor precisa pesar antes de inscrever um projeto.

    Filipe Mendes

    9 de out. de 2026 · 7 min de leitura

    Seguir no Google
    Orange anthropic text in blue circle over abstract background
    Foto por Brecht Corbeel no Unsplash

    O gargalo da segurança de software livre nunca foi achar bug. Sempre foi decidir o que fazer com ele depois.

    Os números que a Anthropic divulgou em 8 de outubro de 2026, no anúncio do OSS Scanner (abre em nova aba), resumem o problema com franqueza incomum. Durante os seis meses anteriores, sob o codinome interno Project Glasswing, a empresa usou seus modelos mais recentes para escanear alguns dos projetos de software mais importantes do mundo em circulação. Os modelos encontraram mais de 29.000 vulnerabilidades candidatas. O time humano conseguiu revisar e triar cerca de 6.000. Quase 5.000 relatórios foram enviados a mantenedores que pediram tudo, inclusive material não validado.

    São números autodeclarados, sem auditoria independente publicada até agora. Mas o formato do funil importa mais que o tamanho: a capacidade de achar falha cresceu uma ordem de grandeza mais rápido que a capacidade humana de conferir cada achado. O OSS Scanner é a resposta institucional para esse desequilíbrio.

    Funil do Project Glasswing antes do lançamento do OSS Scanner
    Unidade: contagem divulgada. Escala a partir de zero.Vulnerabilidades candidatas encontradas29.00029.000Revisadas manualmente6.0006.000Relatórios enviados a mantenedores5.0005.000

    Fonte: Anthropic, anúncio de 8 de outubro de 2026, janela de seis meses

    A resposta ao gargalo foi tirar o humano do meio

    O OSS Scanner (abre em nova aba) é um serviço por adesão (opt-in, na terminologia original): projetos que se inscrevem recebem escaneamentos periódicos e gratuitos feitos pelos modelos mais fortes da Anthropic, incluindo um modelo que a empresa chama de Claude Mythos. Segundo o anúncio, a inspiração declarada é o OSS-Fuzz (abre em nova aba), o programa do Google que aplica fuzzing (geração automática de entradas malformadas para provocar crashes) em projetos críticos. A diferença de método é grande: em vez de perturbar a execução do programa, a Anthropic aplica auditoria semântica por modelo de linguagem, que lê o código e raciocina sobre como ele falha.

    A diferença de processo é ainda maior. Os relatórios do OSS Scanner são integralmente gerados pelo modelo, sem revisão ou triagem humana. A empresa reconhece o efeito colateral com clareza: o mantenedor recebe tudo mais rápido, mas parte do material virá com imprecisões, como severidade mal atribuída. A expectativa divulgada é uma taxa de verdadeiro positivo acima de 90%, com melhoria contínua prometida.

    O serviço é uma das duas frentes da Anthropic Cyber Mission (abre em nova aba), anunciada no mesmo dia. A outra é o Critical Infrastructure Defense Program, que leva modelos, engenheiros e pesquisa de ameaças a defensores de tecnologia operacional. Enquanto o produto comercial Claude Security atende empresas, o OSS Scanner banca do próprio bolso a auditoria de código aberto, com harnesses experimentais e vorazes em tokens. Quem paga a conta, segundo a Anthropic, é o Defender Advantage Fund, fundo lançado em agosto para custear programas-piloto e manter o serviço gratuito.

    Como um projeto entra

    A adesão é deliberadamente burocrática, no bom sentido: um pull request. Mantenedores centrais de projetos elegíveis abrem um PR no repositório do OSS Scanner no GitHub (abre em nova aba) adicionando um arquivo projects/<projeto>/project.yaml. Os campos exigidos são poucos e dizem muito sobre a arquitetura do serviço:

    repoSimLink do repositório git a ser clonado, com #branch opcional; não precisa estar hospedado no GitHubprimary_contactSimContato principal que recebe os relatóriosDockerfileSimCaminho relativo no repositório, para que um agente totalmente offline conduza a auditoriaauto_ccs, homepage, threat_model, pgp, disabledNãoCópias adicionais, site do projeto, modelo de ameaça, chave PGP e desativação

    O Dockerfile é o detalhe tecnicamente mais interessante. Os agentes de escaneamento rodam apenas depois que o acesso à internet é totalmente desativado dentro de sandboxes endurecidos, e o container garante que o ambiente de auditoria seja reproduzível. Depois da primeira inscrição, a Anthropic escaneia o projeto; o pipeline inclui agentes que reverificam bugs, propõem patches e fazem análise de causa raiz. O mantenedor recebe um pacote de relatórios por email, e escaneamentos regulares buscam tanto vulnerabilidades novas quanto as que escaparam antes. A frequência varia conforme o volume de projetos no pipeline, segundo a página do serviço.

    O fluxo prático, conforme a documentação divulgada:

    1. Mantenedor central abre um PR com projects/<projeto>/project.yaml.
    2. A Anthropic roda o primeiro escaneamento em sandbox offline.
    3. O pacote de relatórios chega por email ao primary_contact.
    4. Escaneamentos periódicos recorrentes seguem, com frequência variável.

    O que chega na caixa de entrada, e com que confiança

    Cada relatório contém um reproducer autocontido (código que demonstra a exploração sem depender de contexto externo), a explicação da vulnerabilidade e um patch candidato quando disponível. Quando o histórico permite, o modelo faz bisection, ou seja, a busca binária no histórico do git para apontar o commit que introduziu o bug. Para manutenção de projetos velhos, esse metadado sozinho já economiza horas de arqueologia.

    E os números de validação? Aqui convém separar o que foi medido do que é promessa. Para validar uma versão inicial, testadores de penetração especialistas conferiram 97 vulnerabilidades de severidade crítica e alta, em 48 projetos:

    Atendeu ao critério do processo de CVD da Anthropic85 (88%)Vulnerabilidade real, porém duplicada de problema já conhecido11Inválida1

    CVD é a sigla de coordinated vulnerability disclosure, o processo de divulgação coordenada em que a falha é comunicada ao mantenedor antes de virar pública. Duas ressalvas pesam sobre essa tabela. Primeira: a validação foi feita sobre uma versão inicial do scanner, não sobre o pipeline de produção que agora roda sem revisão humana. Segunda: os números são da própria Anthropic. Ainda não há medição independente publicada da taxa de acerto do serviço em operação, e quem inscrever um projeto está apostando na direção de um indicador, não na medição dele.

    Grátis em tokens, caro em atenção.

    O filtro é impacto, não endereço

    Nada nos critérios divulgados filtra projeto por idioma, jurisdição ou hospedagem. O repositório pode estar em qualquer servidor git, o contato é um email, e o critério formal de elegibilidade segue a lógica do OSS-Fuzz: o projeto precisa ter impacto crítico em infraestrutura e segurança de usuários, decidido caso a caso. Um exemplo hipotético ilustrativo: uma biblioteca de criptografia usada por serviços públicos brasileiros teria argumento forte de impacto; uma ferramenta pessoal, por mais bem escrita, provavelmente não passaria no filtro.

    Para mantenedor com projeto de alcance local, a leitura honesta é que o OSS Scanner não foi pensado para todo repositório, e a Anthropic diz isso sem rodeio: o serviço se destina a projetos com capacidade de acompanhar o volume de achados. Quem não tem essa capacidade continua coberto pela política de CVD da empresa, com divulgações verificadas por humanos, mas no ritmo do gargalo original.

    Há programas adjacentes que podem interessar ao ecossistema brasileiro de código aberto. O anúncio menciona o Claude for Open Source, com assinaturas Claude Max gratuitas para mantenedores, e o Cyber Verification Program, que expande o acesso às capacidades de cibersegurança do Claude para trabalho defensivo. A barra de entrada dos três é diferente; a lógica é a mesma: subsidiar defesa em camadas que o mercado não paga sozinho.

    O que muda para quem mantém software

    A aposta estrutural da Anthropic é que a revisão humana deixou de ser o gargalo obrigatório da auditoria de segurança, e que declarar a taxa de erro é melhor gesto de governança que esconder o funil. Quem trabalha com dependências críticas ganha, no limite, um mantenedor a mais na fila: um revisor incansável, com boa taxa de acerto esperada, sem noção de horário comercial e com propensão documentada a errar a severidade. Para o mantenedor que recebe o relatório, a triagem continua sendo trabalho humano. Só que agora ela começa com um reproducer, um patch candidato e um commit de origem na mesa, em vez de começar do zero.

    A síntese da empresa cabe num post. No anúncio oficial no X, a Anthropic resumiu o contrato do serviço:

    Para proteger o software de código aberto, estamos lançando o OSS Scanner. Usaremos nossos modelos de fronteira para escanear periodicamente, sem custo, os projetos de código aberto que aderirem, em busca de vulnerabilidades. Nossos relatórios trarão uma prova de conceito, uma explicação e uma correção sugerida.

    — Anthropic (@AnthropicAI), 8 de out. de 2026, no X

    Perguntas frequentes

    Como inscrever um projeto no OSS Scanner?

    Um mantenedor central abre um pull request no repositório anthropics/oss-scanner no GitHub, adicionando projects/<projeto>/project.yaml com os campos obrigatórios: repo, primary_contact e Dockerfile. A Anthropic então executa o primeiro escaneamento e envia os relatórios por email.

    O OSS Scanner cobra algo dos projetos participantes?

    Não. Segundo a Anthropic, os escaneamentos são gratuitos, custeados pelo Defender Advantage Fund (0xDAF), fundo lançado em agosto para financiar programas de defesa. O serviço usa harnesses experimentais e de alto consumo de tokens, com custo integral coberto pela empresa.

    Os relatórios passam por revisão humana?

    Não. Os relatórios do OSS Scanner são gerados integralmente pelos modelos, sem revisão ou triagem humana, o que acelera a entrega mas admite imprecisões, como severidade mal atribuída. A Anthropic espera uma taxa de verdadeiro positivo acima de 90%. Em validação anterior de uma versão inicial, 85 de 97 vulnerabilidades críticas e altas (88%) atenderam ao critério de divulgação coordenada.

    Quais projetos são elegíveis ao OSS Scanner?

    O critério divulgado segue a lógica do OSS-Fuzz: o projeto precisa ter impacto crítico em infraestrutura e segurança de usuários, avaliado caso a caso. Não há filtro declarado por idioma, jurisdição ou hospedagem, mas projetos sem capacidade de acompanhar os achados devem continuar recebendo divulgações via CVD, com verificação humana.

    Fontes

    Filipe Mendes

    Ver perfil completo