Ciberseguridad

OpenAI revela Astra como el primer modelo que alcanza su umbral de «capacidad cibernética crítica»

OpenAI afirmó que el modelo Astra puede detectar vulnerabilidades desconocidas y desarrollar métodos para explotarlas, y que obtuvo una puntuación perfecta en la prueba ExploitBench. La empresa implementará gradualmente sus capacidades cibernéticas para usuarios de prueba después de aplazar parte del proceso de desarrollo para añadir controles de seguridad, sin que hasta ahora exista una verificación independiente.

2026-09-02
4 min de lectura
6 visitas
certi.news
OpenAI revela Astra como el primer modelo que alcanza su umbral de «capacidad cibernética crítica»

OpenAI reveló nuevos detalles sobre el modelo de inteligencia artificial Astra, que se prepara para poner a disposición próximamente, y afirmó que es su primer modelo en alcanzar el nivel de «capacidad cibernética crítica» dentro del Preparedness Framework. Según la descripción de la empresa, esto significa que el modelo puede, cuando se le proporcionan las herramientas y los derechos de acceso adecuados, detectar vulnerabilidades de seguridad que antes no eran conocidas y desarrollar métodos para explotarlas.

El avance no se refiere únicamente a la capacidad del modelo para analizar código o proponer correcciones, sino también a su capacidad para ejecutar etapas avanzadas de la cadena de explotación. Por este motivo, OpenAI retrasó parte del desarrollo y el lanzamiento de Astra, mientras trabajaba durante las últimas semanas para reducir la posibilidad de que se utilizara en ciberataques dañinos o para ejecutar operaciones no autorizadas.

Resultados sólidos en pruebas de explotación

OpenAI afirmó que Astra obtuvo una puntuación del 100 % en la prueba ExploitBench, que mide la capacidad de desarrollar software de explotación para vulnerabilidades conocidas. La empresa también realizó una evaluación interna que incluyó 20 vulnerabilidades críticas anunciadas durante el periodo comprendido entre junio y agosto de 2026.

Según los resultados comunicados por OpenAI, Astra alcanzó en esta evaluación tasas más altas de ejecución remota de código que el modelo GPT-5.6 Sol, utilizando un número menor de unidades de tokens. Durante la prueba, la empresa afirmó que el modelo detectó y utilizó dos vulnerabilidades de tipo «día cero» dentro de una cadena de explotación, y que comenzó a informar de estas vulnerabilidades a los desarrolladores de software afectados.

Otras pruebas realizadas por expertos evaluaron la capacidad de Astra para explotar vulnerabilidades desconocidas en un navegador aislado, salir del entorno de aislamiento y ejecutar comandos en el sistema anfitrión. En las pruebas de sistemas operativos, el modelo logró, según OpenAI, encadenar varias vulnerabilidades para pasar de un usuario no autorizado a privilegios de root.

Disponibilidad limitada y controles adicionales

OpenAI planea ofrecer por etapas las capacidades cibernéticas más avanzadas de Astra. La primera etapa se limitará a un grupo de usuarios participantes en las pruebas, antes de ampliar el acceso a usos defensivos mediante el programa Daybreak Blue.

La empresa afirma que aumentó la tasa de rechazo de Astra ante solicitudes cibernéticas dañinas y que impondrá restricciones más estrictas a las cuentas que considere de alto riesgo. También añadirá mecanismos de monitorización para detectar comportamientos no autorizados, junto con capas de razonamiento y supervisión de las acciones que ejecute el modelo.

¿Por qué importa esta noticia?

Lo que cambia en la práctica es que un modelo general pasa a un nivel en el que puede, según las pruebas de la empresa, contribuir a detectar y explotar vulnerabilidades mediante una cadena de varios pasos. Esto podría beneficiar a los equipos de defensa y a los investigadores de seguridad si el uso permanece limitado a entornos autorizados, pero al mismo tiempo aumenta la importancia de controlar el acceso y la monitorización, porque las mismas capacidades podrían reducir el esfuerzo necesario para desarrollar ataques complejos.

Aquí destacan los límites de la información disponible. Las cifras y los resultados mencionados proceden de OpenAI, y hasta ahora no existe una verificación independiente del nivel de seguridad de Astra ni de las medidas para limitar su uso indebido. Además, el sistema completo y los resultados detallados de las evaluaciones no se publicarán, según el artículo, hasta el lanzamiento oficial. Por ello, la evaluación práctica de las capacidades y los riesgos del modelo dependerá del sistema de seguridad publicado y de los resultados de pruebas independientes después de su disponibilidad, no únicamente de las afirmaciones iniciales sobre su rendimiento.

Fuente de la noticia
c
Autor

certi.news

De la misma categoría

También te puede interesar

Ver todas las noticias