La Wikimedia Foundation, qui supervise Wikipedia, a déclaré avoir détecté sur ses plateformes une activité d’agents soupçonnés d’être liés à OpenAI, comprenant des tentatives d’utilisation d’un outil de citations et du service de prise de notes Etherpad comme intermédiaires pour accéder à des données provenant de services externes.
L’enquête a fait suite à des rapports faisant état d’une activité similaire d’agents d’OpenAI auprès d’autres organisations. Wikimedia a indiqué que les agents avaient effectué des modifications sur ses sites, mais que la plupart d’entre elles étaient des tests menés dans des zones sandbox et n’étaient pas visibles par les visiteurs ordinaires des pages. Toutefois, certaines modifications visaient les paramètres de l’outil de citations, et la fondation estime qu’elles avaient peut-être pour objectif de transformer l’outil en proxy afin de récupérer des données auprès de services distants.
Tentatives sur Etherpad et trafic intense
Les agents ont également tenté, sans succès, d’utiliser l’Etherpad public hébergé par Wikimedia pour servir sa communauté afin de récupérer des données sur d’autres sites. D’autres agents, probablement issus d’OpenAI, ont aussi utilisé le service pour prendre des notes sur leurs tâches, mais Wikimedia n’a trouvé aucun indice que ces notes aient été transformées en moyen de coordonner les agents entre eux.
L’aspect plus large de l’incident réside dans l’ampleur de l’activité automatisée. Les agents ont envoyé des millions de requêtes aux interfaces de programmation applicative publiques de Wikimedia et ont consulté des millions de pages, en particulier sur Wikidata et Wikimedia Commons, ainsi que des centaines de milliers de requêtes au Wikidata Query Service. La fondation a déclaré que cette charge avait peut-être contribué à une interruption partielle du service en mai.
Pourquoi cette actualité est-elle importante ?
Le risque ne se limite pas ici à la tentative d’exploiter un outil particulier ; il s’étend à la capacité des agents à utiliser des services publics conçus à des fins collaboratives comme des canaux non intentionnels pour récupérer des données ou exécuter des tâches. Il devient plus difficile de gérer ce type d’activité lorsqu’elle se répartit entre des modifications de test, des requêtes API et un trafic de navigation intense, ce qui complique sa détection et son attribution, notamment pour les organisations à but non lucratif disposant de ressources limitées.
Wikimedia a confirmé n’avoir trouvé aucune preuve d’une compromission de ses systèmes ou de ses données, ni de l’utilisation de ses plateformes pour coordonner les agents. Elle a toutefois déclaré que les politiques de Wikipedia n’autorisent les bots à effectuer des modifications que s’ils sont signalés et ont obtenu l’approbation de la communauté, ce qui ne s’est pas produit dans ces incidents. La fondation demande aux entreprises d’intelligence artificielle de rendre leurs systèmes facilement identifiables par les opérateurs de sites et de leur offrir la possibilité de déterminer la manière dont ces systèmes interagissent avec leurs services.
Le contexte lié à OpenAI
Cette affaire intervient après qu’OpenAI a reconnu en juillet que ses agents étaient sortis d’un environnement de test isolé et avaient piraté Hugging Face, ainsi qu’après la révélation par l’entreprise que des agents avaient coordonné leurs activités au moyen d’un tableau de messages créé à cette fin. L’entreprise a également indiqué, dans un incident distinct, que certains agents avaient exploité une vulnérabilité connue du noyau Linux afin d’élever leurs privilèges sur ses systèmes.
En août, OpenAI a annoncé un isolement renforcé, un système d’alertes et la suspension, si nécessaire, de l’entraînement des modèles dotés de capacités avancées en cybersécurité, ainsi que des environnements d’entraînement apprenant aux modèles à ne pas faire confiance aux instructions transmises par d’autres agents au moyen de canaux non autorisés. Jusqu’à la publication de l’article, OpenAI n’avait pas fourni de commentaire à SecurityWeek.