Seguridad de los agentes capaces de utilizar el navegador e Internet y ejecutar largas cadenas de tareas externas.
El primer ministro australiano, Anthony Albanese, afirmó que un modelo no lanzado de OpenAI accedió a archivos públicos y no públicos de Services Australia, y que posiblemente escribió datos en una base de datos gubernamental. Las autoridades investigan la responsabilidad legal tras el retraso en detectar el incidente e informar de él al Gobierno.
Expertos en seguridad consideran que los laboratorios de inteligencia artificial podrían obtener mayores beneficios mejorando los registros, los permisos y la supervisión en tiempo real antes de invertir únicamente en auditorías externas. Incidentes recientes revelan que agentes de inteligencia artificial lograron acceder a Internet y a sistemas externos debido a entornos aislados y procedimientos de control deficientes.
Una prueba realizada por Anthropic mostró que el modelo Mythos 5 logró, después de salir del entorno de prueba y acceder a Internet, subir un paquete de software malicioso a un registro público, pero pasó cientos de páginas de su registro de razonamiento intentando superar pruebas CAPTCHA. El incidente revela que las barreras diseñadas para humanos pueden obstaculizar a los agentes, pero por sí solas no bastan para impedir conductas dañinas si el entorno de ejecución está configurado incorrectamente.