Anthropic anunció el 6 de octubre de 2026 la ampliación del Cyber Verification Program (CVP), que permite a entidades de seguridad cualificadas utilizar capacidades cibernéticas avanzadas y barreras de clasificación menos restrictivas según la naturaleza de su trabajo. El programa incluye los modelos Claude Opus 5.5, Claude Sonnet 5.5 y Claude Mythos 5.1, además de modelos futuros.
Tres niveles según el tipo de trabajo
El programa comienza con el nivel Defense Access, destinado a operaciones defensivas, como tareas de centros de operaciones de seguridad y respuesta a incidentes, ingeniería inversa de malware y análisis y verificación de vulnerabilidades. Entre las posibles entidades se incluyen equipos de seguridad de empresas, universidades y organismos gubernamentales, operadores de infraestructuras críticas, empresas de seguridad más pequeñas, mantenedores de proyectos de código abierto e investigadores individuales con un historial verificado de notificación de vulnerabilidades. Anthropic espera responder a las solicitudes en un plazo de días.
Por su parte, Red Team Access añade pruebas de penetración y equipos de simulación ofensiva, con la condición de que las pruebas se limiten a sistemas que los solicitantes estén autorizados a probar. Siguen estando prohibidas en todo momento acciones como desplegar ransomware, dañar sistemas físicos o probar sistemas de seguridad de alto riesgo. Este nivel se limita actualmente a instituciones, y su revisión puede tardar semanas; los solicitantes cualificados se incorporarán temporalmente al nivel Defense Access.
Specialized Access queda reservado para un número limitado de instituciones verificadas autorizadas a probar sistemas cuyo fallo podría afectar a la vida de las personas o a los mercados, como sistemas operativos de aeronaves, redes eléctricas y de telecomunicaciones, infraestructuras de transferencias interbancarias y redes gubernamentales. Anthropic revisa cada institución de este nivel en colaboración con el Gobierno de Estados Unidos. Asimismo, los miembros actuales de Project Glasswing pasarán al nuevo nivel sin necesidad de volver a certificar los modelos actuales.
Probar el equilibrio entre utilidad y prevención
Anthropic probó el modelo Claude Opus 5.5 mediante CyScenarioBench, una evaluación que mide la planificación y ejecución de operaciones cibernéticas de varias etapas en condiciones reales. Sin acceso a CVP, las diez tareas quedaron bloqueadas en el primer intento. En Defense Access, 46 de 50 intentos fueron bloqueados en algún momento, mientras que cuatro tuvieron éxito. En Red Team Access no se produjo ningún bloqueo, y el modelo completó 34 de 50 tareas, prácticamente el mismo resultado que obtuvo al ejecutarse sin barreras de protección, con una tasa de éxito del 67,6%.
¿Qué cambia en la práctica?
El cambio principal no consiste en abrir las capacidades cibernéticas a todo el mundo, sino en separarlas de los modelos disponibles de forma general mediante una verificación multinivel que vincula la potencia del modelo con el tipo de autorización y los controles requeridos. Los modelos generales siguen siendo adecuados para revisar código, corregir problemas conocidos, encontrar vulnerabilidades en código propio y clasificar alertas de seguridad.
Anthropic afirma que los socios de Project Glasswing descubrieron al menos 129.000 vulnerabilidades de software verificadas entre abril y julio de 2026, mientras que las operaciones de análisis de código abierto realizadas por la empresa encontraron 5.500 vulnerabilidades adicionales entre abril y octubre. Hasta ahora, más de 33.000 han sido clasificadas como críticas o de alto riesgo, aunque la empresa advierte que las cifras podrían ser inferiores a las reales porque dependen parcialmente de datos de análisis procedentes de una muestra de socios.
La adhesión al programa exige conservar los datos para supervisar el uso indebido cibernético. Anthropic afirma que las instituciones cualificadas podrán utilizar posteriormente Enterprise Frontier Safeguards, que combina la retención cero de datos con controles de protección y el almacenamiento de datos en una infraestructura en la nube controlada por la institución. Hasta que esté disponible, algunos usuarios de Claude Fable 5.1 o Claude Mythos 5.1 con retención cero podrán utilizar CVP bajo esta política.
Lectura de certi.news: El programa refleja un intento práctico de resolver el dilema del uso dual en los modelos de inteligencia artificial: impedir el uso ofensivo general sin privar a los equipos defensivos de herramientas que puedan acelerar el descubrimiento de vulnerabilidades. Sin embargo, los resultados de las pruebas proceden de la propia Anthropic, y el paso a niveles de acceso superiores requiere verificación institucional y supervisión continua, mientras que el momento de disponibilidad de EFS y el mecanismo detallado de evaluación de la elegibilidad siguen siendo puntos abiertos.