A iniciativa OSS Scanner da Anthropic mostrou que a descoberta de vulnerabilidades em software de código aberto se tornou muito mais rápida do que a capacidade dos responsáveis pela manutenção desses projetos de verificá-las e corrigi-las. Após seis meses examinando projetos de código aberto amplamente utilizados, os modelos da empresa identificaram mais de 29.000 possíveis vulnerabilidades de segurança, mas apenas 516 vulnerabilidades haviam sido corrigidas upstream até 2 de outubro de 2026.
De acordo com o painel de divulgação da iniciativa, seis empresas externas de pesquisa em segurança revisaram 6.123 resultados e confirmaram a validade de 5.674 deles. Ao todo, a Anthropic enviou 6.157 resultados aos maintainers, o que levou à emissão de 584 identificadores do tipo CVE ou GitHub Security Advisory, com a possibilidade de alguns resultados receberem ambos os identificadores. Enquanto isso, cerca de 23.000 possíveis vulnerabilidades permaneceram sem revisão humana.
Um caminho rápido que não espera pela verificação completa
Para reduzir o impacto do acúmulo de resultados, a Anthropic disponibilizou aos projetos elegíveis verificações periódicas gratuitas usando seus modelos de maior capacidade, incluindo o Claude Mythos. Nesse caminho, os resultados são enviados diretamente aos maintainers antes de serem verificados pela empresa, no que a Anthropic chama de “caminho rápido opcional”. A empresa enviou cerca de 5.000 relatórios não verificados a projetos que solicitaram acesso a esses resultados.
Os projetos são compilados dentro de máquinas virtuais isoladas, e sua conexão com a internet é interrompida durante a verificação. Quando possível, os relatórios também incluem uma ferramenta para reproduzir o problema, uma explicação sobre o local de sua introdução por meio da técnica de bisection e uma correção proposta. O repositório da iniciativa no GitHub não inclui o próprio scanner, mas sim ferramentas de registro e configuração.
Resultados fortes, mas não um veredito final
Em um teste inicial que abrangeu 97 resultados de gravidade alta ou crítica distribuídos por 48 projetos, 85 resultados ultrapassaram o limite para divulgação. Dos 12 resultados restantes, 11 eram problemas reais, mas repetidos em relação a problemas conhecidos ou a outros resultados, enquanto apenas um resultado era um falso positivo. No entanto, essa amostra não representa necessariamente todos os 29.000 resultados, nem esclarece o desempenho da ferramenta em vulnerabilidades de baixa gravidade ou quando executada em grande escala.
A Anthropic também reconheceu que os maintainers relataram uma superestimação da gravidade de alguns resultados e casos em que o scanner interpretou incorretamente o modelo de ameaça do projeto. Portanto, cada possível vulnerabilidade não pode ser tratada como uma vulnerabilidade confirmada antes da revisão humana.
Por que esta notícia é importante?
Depoimentos de projetos como OpenSSL, wolfSSL, PostgreSQL e curl indicam que alguns relatórios foram úteis e puderam ser verificados rapidamente, e que alguns incluíam correções que podiam ser utilizadas praticamente sem alterações. Mas a lacuna entre 5.674 resultados confirmados e 516 correções revela que o gargalo nem sempre está em encontrar a falha, mas em testá-la, fazer o backport para as versões compatíveis, avaliar seu impacto sobre o comportamento compatível com os usuários e, então, publicar a correção.
A Anthropic limita o acesso a projetos de código aberto amplamente utilizados e críticos para a segurança, segundo critérios semelhantes aos do OSS-Fuzz, verificando que o solicitante seja um maintainer principal e que o projeto já acompanhe as vulnerabilidades confirmadas de gravidade alta e crítica. Um relato não verificado não impõe um prazo de divulgação de 90 dias, enquanto esse prazo começa quando a Anthropic confirma o resultado por meio de seu programa habitual. A empresa afirma que poderá posteriormente impor um prazo a alguns resultados de alta gravidade, depois de oferecer aos projetos a oportunidade de optar por não participar.
Na prática, o OSS Scanner oferece uma nova capacidade para ampliar o alcance da pesquisa de segurança, mas não elimina o trabalho humano necessário para transformar os resultados em correções publicadas. Além disso, oferecer gratuitamente aos projetos assinaturas Claude Max 20x por meio do Claude for OSS pode ajudar na análise e na programação, mas não fornece o tempo necessário para revisão, testes e manutenção.