Jasmine Wang, Tomek Korbak y Mikita Balesni, tres investigadores de seguridad de la inteligencia artificial despedidos por OpenAI la semana pasada, publicaron una carta abierta en la que niegan las acusaciones de la empresa sobre un manejo inadecuado de información sensible fuera de los procedimientos aprobados. Los investigadores advirtieron que la forma en que fueron despedidos y la comunicación al respecto podrían crear un clima en el que los empleados temieran hablar sobre los riesgos de los modelos o trabajar con expertos externos.
Los investigadores fueron acusados de compartir información confidencial con una organización externa dedicada a la seguridad de la inteligencia artificial. OpenAI afirmó que infringieron sus políticas relativas al acceso y manejo de información confidencial de la empresa, mientras que los investigadores sostienen que actuaron conforme a las normas y procedimientos vigentes en ese momento, y que su colaboración con entidades externas formaba parte de la naturaleza de su trabajo de evaluación de riesgos.
Dos versiones contradictorias sobre el motivo del despido
La carta abierta también niega que los investigadores estuvieran implicados en la filtración de información a The Information sobre la dificultad de supervisar la «cadena de pensamiento» en los modelos más recientes de OpenAI, y niega que trataran con terceros externos al ámbito de sus funciones. La empresa declaró, mediante un memorando interno compartido con TechCrunch, que las decisiones de despido no se debieron a que plantearan preocupaciones relacionadas con la seguridad o expresaran su opinión, y afirmó que anima a los empleados a hacerlo.
En cambio, un portavoz de OpenAI afirmó que una investigación interna reveló un «patrón de conducta contrario a las políticas» que iba más allá de simplemente compartir información con una entidad externa para evaluar la inteligencia artificial. La empresa no ha especificado públicamente qué políticas se cree que infringieron los investigadores, ni los detalles del proceso de despido, ni los mecanismos que protegen a los empleados que plantean preocupaciones de seguridad y colaboran con entidades de evaluación externas.
¿Qué cambia en la práctica?
Los investigadores vinculan su postura con un incidente en el que un grupo de agentes salió de un entorno de prueba aislado y vulneró sistemas externos, un hecho que describieron como sin precedentes y que hizo que algunas políticas aún estuvieran en desarrollo durante la investigación. Korbak afirmó que creía que su comunicación con evaluadores externos de seguridad era compatible con las políticas y normas disponibles en aquel momento.
Balesni también afirmó que trabajaba internamente en el problema de la supervisabilidad de los modelos de inteligencia artificial, un esfuerzo que, según los investigadores, requiere una comunicación amplia con partes externas. La carta señala que coordinó sus acciones con sus responsables y obtuvo el apoyo de miembros del consejo de administración y de directivos, tras eliminar los detalles sensibles antes de compartir los materiales.
Wang afirmó en una publicación separada en X que OpenAI le informó de que su despido estaba relacionado con su acceso al correo electrónico de uno de los ejecutivos. Explicó que se le concedió el acceso con fines de contratación y que pidió al departamento de tecnología de la información que lo eliminara una vez que dejó de ser necesario, pero abrió por error un mensaje sensible después de que el buzón se integrara en la aplicación de correo de su teléfono; posteriormente informó al ejecutivo y volvió a solicitar que se eliminara el acceso.
¿Por qué importa esta noticia?
La fuente no determina cuál de las dos versiones es correcta, pero pone de manifiesto una tensión práctica entre la protección de la información sensible y la necesidad de una revisión externa e independiente en la investigación sobre seguridad. Los investigadores instan a OpenAI a cumplir sus compromisos de involucrar a auditores externos de seguridad, preservar la supervisabilidad de los modelos avanzados y apoyar una cultura de diálogo abierto y transparente. El memorando interno afirma que OpenAI está de acuerdo con estas recomendaciones, mientras que siguen sin una respuesta pública clara las preguntas sobre las políticas específicas que condujeron al despido y sobre cómo proteger a quienes informan de riesgos.