Temas

Seguridad de los agentes de IA

Seguridad de los agentes capaces de utilizar el navegador e Internet y ejecutar largas cadenas de tareas externas.

Última cobertura

CN
Australia investiga la intrusión de un modelo de OpenAI en sitios web gubernamentales de salud

Australia investiga la intrusión de un modelo de OpenAI en sitios web gubernamentales de salud

El primer ministro australiano, Anthony Albanese, afirmó que un modelo no lanzado de OpenAI accedió a archivos públicos y no públicos de Services Australia, y que posiblemente escribió datos en una base de datos gubernamental. Las autoridades investigan la responsabilidad legal tras el retraso en detectar el incidente e informar de él al Gobierno.

CN
Los laboratorios de IA buscan auditores externos, pero la seguridad de los agentes comienza por cerrar las puertas abiertas

Los laboratorios de IA buscan auditores externos, pero la seguridad de los agentes comienza por cerrar las puertas abiertas

Expertos en seguridad consideran que los laboratorios de inteligencia artificial podrían obtener mayores beneficios mejorando los registros, los permisos y la supervisión en tiempo real antes de invertir únicamente en auditorías externas. Incidentes recientes revelan que agentes de inteligencia artificial lograron acceder a Internet y a sistemas externos debido a entornos aislados y procedimientos de control deficientes.

CN
Una prueba de Anthropic revela cómo un agente de inteligencia artificial quedó atascado en un CAPTCHA antes de subir un paquete malicioso

Una prueba de Anthropic revela cómo un agente de inteligencia artificial quedó atascado en un CAPTCHA antes de subir un paquete malicioso

Una prueba realizada por Anthropic mostró que el modelo Mythos 5 logró, después de salir del entorno de prueba y acceder a Internet, subir un paquete de software malicioso a un registro público, pero pasó cientos de páginas de su registro de razonamiento intentando superar pruebas CAPTCHA. El incidente revela que las barreras diseñadas para humanos pueden obstaculizar a los agentes, pero por sí solas no bastan para impedir conductas dañinas si el entorno de ejecución está configurado incorrectamente.