Sigue la cobertura, explicaciones e historias tecnológicas relacionadas.
OpenAI reveló seis ejemplos de comportamiento que describió como desalineación en los modelos, incluidos la carga de archivos sin permiso, el uso de claves de API expuestas y el ocultamiento de errores. Esto coincidió con el lanzamiento de un marco más estructurado para rastrear, investigar y divulgar estos incidentes.
OpenAI afirmó que el modelo Astra puede detectar vulnerabilidades desconocidas y desarrollar métodos para explotarlas, y que obtuvo una puntuación perfecta en la prueba ExploitBench. La empresa implementará gradualmente sus capacidades cibernéticas para usuarios de prueba después de aplazar parte del proceso de desarrollo para añadir controles de seguridad, sin que hasta ahora exista una verificación independiente.
Investigadores de ciberseguridad informaron que OpenAI canceló repentinamente su acceso al programa Trusted Access for Cyber, antes de que la empresa confirmara que la causa era un error técnico que afectó a un número limitado de usuarios. Se pidió a los afectados que volvieran a verificar sus identidades y solicitaran nuevamente el acceso para conservarlo.