Anthropic a annoncé le 6 octobre 2026 l’extension du Cyber Verification Program (CVP), permettant à des entités de sécurité qualifiées d’utiliser des capacités cybernétiques avancées et des garde-fous de classification moins restrictifs selon la nature de leur travail. Le programme inclut les modèles Claude Opus 5.5, Claude Sonnet 5.5 et Claude Mythos 5.1, ainsi que les futurs modèles.
Trois niveaux selon le type de travail
Le programme commence par le niveau Defense Access, destiné aux opérations défensives, comme les missions des centres des opérations de sécurité et de réponse aux incidents, la rétro-ingénierie des logiciels malveillants, ainsi que l’analyse et la vérification des vulnérabilités. Les entités potentiellement concernées comprennent les équipes de sécurité des entreprises, des universités et des organismes gouvernementaux, les opérateurs d’infrastructures critiques, les petites entreprises de sécurité, les responsables de projets open source et les chercheurs individuels disposant d’un historique vérifié de signalement de vulnérabilités. Anthropic prévoit de répondre aux demandes sous quelques jours.
Le niveau Red Team Access ajoute les tests d’intrusion et les équipes de simulation offensive, à condition que les tests se limitent aux systèmes que les candidats sont autorisés à tester. Des actions telles que le déploiement de rançongiciels, l’endommagement de systèmes physiques ou le test de systèmes de sécurité à haut risque restent immédiatement interdites. Ce niveau est actuellement limité aux institutions, et son examen peut prendre plusieurs semaines ; les candidats qualifiés sont temporairement inscrits au niveau Defense Access.
Le niveau Specialized Access est réservé à un nombre limité d’institutions vérifiées autorisées à tester des systèmes dont l’interruption pourrait affecter la vie des personnes ou les marchés, comme les systèmes d’exploitation des avions, les réseaux électriques et de télécommunications, les infrastructures de transfert interbancaire et les réseaux gouvernementaux. Anthropic examine chaque institution de ce niveau en coopération avec le gouvernement américain. Les membres actuels de Project Glasswing passeront également au nouveau niveau sans nouvelle certification pour les modèles actuels.
Tester l’équilibre entre utilité et blocage
Anthropic a testé le modèle Claude Opus 5.5 au moyen de CyScenarioBench, une évaluation qui mesure la planification et l’exécution d’opérations cybernétiques en plusieurs étapes dans des conditions réalistes. Sans accès au CVP, les dix tâches ont été bloquées dès la première tentative. Avec Defense Access, 46 des 50 tentatives ont été bloquées à un moment donné, tandis que quatre tentatives ont réussi. Avec Red Team Access, aucun blocage ne s’est produit et le modèle a accompli 34 des 50 tâches, soit à peu près le même résultat que lorsqu’il fonctionnait sans garde-fous, avec un taux de réussite de 67,6 %.
Qu’est-ce qui change concrètement ?
Le changement essentiel ne consiste pas à ouvrir les capacités cybernétiques à tout le monde, mais à les séparer des modèles généralement disponibles grâce à une vérification à plusieurs niveaux, qui relie la puissance du modèle au type d’autorisation et aux contrôles requis. Les modèles généraux restent adaptés à la revue de code, à la correction de problèmes connus, à la recherche de vulnérabilités dans du code détenu par l’utilisateur et au tri des alertes de sécurité.
Anthropic affirme que les partenaires de Project Glasswing ont découvert au moins 129 000 vulnérabilités logicielles documentées entre avril et juillet 2026, tandis que les opérations d’analyse open source menées par l’entreprise ont trouvé 5 500 vulnérabilités supplémentaires entre avril et octobre. Plus de 33 000 d’entre elles ont jusqu’à présent été classées comme critiques ou présentant un risque élevé, l’entreprise avertissant que les chiffres pourraient être inférieurs à la réalité, car ils reposent en partie sur des données d’analyse provenant d’un échantillon de partenaires.
L’adhésion au programme exige la conservation des données afin de surveiller les abus cybernétiques. Anthropic affirme que les institutions éligibles pourront ultérieurement utiliser Enterprise Frontier Safeguards, qui combine la conservation nulle des données et des contrôles de protection, avec le stockage des données dans une infrastructure cloud contrôlée par l’institution. En attendant sa disponibilité, certains utilisateurs de Claude Fable 5.1 ou de Claude Mythos 5.1 bénéficiant de la conservation nulle des données peuvent utiliser le CVP avec cette politique.
Lecture de certi.news : le programme reflète une tentative pratique de résoudre le dilemme de l’usage dual dans les modèles d’intelligence artificielle : empêcher l’utilisation offensive généralisée sans priver les équipes de défense d’outils susceptibles d’accélérer la découverte des vulnérabilités. Toutefois, les résultats des tests proviennent d’Anthropic elle-même, et le passage aux niveaux d’accès supérieurs nécessite une vérification institutionnelle ainsi qu’une surveillance continue, tandis que le calendrier de disponibilité d’EFS et le mécanisme détaillé d’évaluation de l’éligibilité restent des points ouverts.