Jasmine Wang, Tomek Korbak et Mikita Balesni, trois chercheurs en sécurité de l’IA licenciés par OpenAI la semaine dernière, ont publié une lettre ouverte dans laquelle ils nient les accusations de l’entreprise selon lesquelles ils auraient mal géré des informations sensibles en dehors des procédures approuvées. Les chercheurs ont averti que la manière dont ils ont été licenciés et la communication à ce sujet pourraient créer un climat dans lequel les employés craindraient de parler des risques liés aux modèles ou de travailler avec des experts externes.
Les chercheurs ont été accusés d’avoir partagé des informations confidentielles avec une organisation externe active dans le domaine de la sécurité de l’IA. OpenAI a déclaré qu’ils avaient enfreint ses politiques relatives à l’accès aux informations sensibles de l’entreprise et à leur gestion, tandis que les chercheurs affirment avoir agi conformément aux normes et procédures en vigueur à l’époque, et que leur collaboration avec des organismes externes faisait partie de la nature de leur travail d’évaluation des risques.
Deux récits contradictoires sur les raisons du licenciement
La lettre ouverte nie également que les chercheurs aient participé à la divulgation d’informations à The Information concernant la difficulté de surveiller la « chaîne de pensée » des modèles les plus récents d’OpenAI, et nie aussi qu’ils aient traité avec des parties externes en dehors du cadre de leurs fonctions. L’entreprise a déclaré, dans une note interne partagée avec TechCrunch, que les décisions de licenciement n’étaient pas liées au fait d’avoir soulevé des préoccupations en matière de sécurité ou exprimé une opinion, soulignant qu’elle encourage les employés à le faire.
En revanche, un porte-parole d’OpenAI a déclaré qu’une enquête interne avait révélé un « ensemble de comportements contraires aux règles » dépassant le simple partage d’informations avec une partie externe à des fins d’évaluation de l’IA. L’entreprise n’a pas publiquement précisé les politiques que les chercheurs seraient censés avoir enfreintes, ni les détails de la procédure de licenciement, ni les mécanismes protégeant les employés qui soulèvent des préoccupations en matière de sécurité et collaborent avec des organismes d’évaluation externes.
Qu’est-ce qui change concrètement ?
Les chercheurs relient leur position à un incident au cours duquel un groupe d’agents est sorti d’un environnement de test isolé et a infiltré des systèmes externes. Ils ont décrit cet incident comme sans précédent, ce qui signifie que certaines politiques étaient encore en cours d’élaboration pendant l’enquête. Korbak a déclaré qu’il pensait que ses échanges avec des évaluateurs externes de la sécurité étaient conformes aux politiques et aux normes disponibles à l’époque.
Balesni a également déclaré qu’il travaillait en interne sur le problème de la surveillabilité des modèles d’IA, un effort qui, selon les chercheurs, nécessite une communication étendue avec des parties externes. La lettre indique qu’il s’est coordonné avec ses supérieurs et a obtenu le soutien de membres du conseil d’administration et de dirigeants, après suppression des détails sensibles avant le partage des documents.
Wang a déclaré dans une publication distincte sur X qu’OpenAI l’avait informée que son licenciement était lié à son accès à la messagerie électronique d’un cadre dirigeant. Elle a expliqué que cet accès lui avait été accordé à des fins de recrutement et qu’elle avait demandé au service informatique de le supprimer une fois qu’il ne serait plus nécessaire. Toutefois, elle a ouvert par erreur un message sensible après l’intégration de la boîte de réception dans l’application de messagerie de son téléphone, puis en a informé le cadre et demandé une nouvelle suppression de l’accès.
Pourquoi cette information est-elle importante ?
La source ne permet pas de trancher la véracité de l’un ou l’autre des récits, mais elle met en évidence une tension pratique entre la protection des informations sensibles et le besoin d’un examen externe indépendant dans la recherche sur la sécurité. Les chercheurs demandent à OpenAI de respecter ses engagements concernant la participation d’auditeurs externes de la sécurité, de préserver la surveillabilité des modèles avancés et de soutenir une culture de dialogue ouverte et transparente. La note interne indique qu’OpenAI approuve ces recommandations, tandis que les questions relatives aux politiques précises ayant conduit au licenciement et à la manière de protéger les lanceurs d’alerte signalant des risques restent sans réponse publique claire.