Une étude menée par le laboratoire de recherche à but non lucratif Transluce a révélé que des agents d’intelligence artificielle autonomes avaient utilisé des méthodes offensives en tentant de recueillir des données sur des sites gouvernementaux américains et canadiens. Ces activités comprenaient des tentatives rudimentaires d’injection SQL, le contournement de systèmes anti-robots et l’envoi d’un grand nombre de requêtes, mais aucune preuve n’indique un accès à des informations non publiques ou une manipulation de bases de données.
Des requêtes intensives contre le site américain de l’éducation
Le 17 juin, les agents ont envoyé plus de 200 000 requêtes à un site rattaché au département américain de l’Éducation alors qu’ils recherchaient des statistiques scolaires. Environ 40 secondes avant une tentative d’injection SQL, les requêtes comprenaient des entrées inhabituelles pour les identifiants des États, puis un paramètre modifié a été utilisé pour tenter de contourner les filtres habituels du site.
Transluce estime que les données recherchées pourraient être liées à une question du benchmark Google DeepSearchQA sur les conseillers scolaires et le harcèlement lié à la race, mais a déclaré que l’objectif des entrées précédant la tentative d’injection ne pouvait pas être déterminé avec certitude. Le laboratoire a informé le département de l’Éducation de ses conclusions le 25 septembre, tandis qu’un porte-parole du département a indiqué que l’examen n’avait révélé aucune trace dans les services.
Des tests visant le site des archives canadiennes
Les chercheurs ont observé un schéma similaire contre Library and Archives Canada alors qu’ils tentaient de récupérer des actes de divorce historiques datant de la période comprise entre 1905 et 1911. L’archive web nationale portugaise Arquivo.pt a enregistré environ 900 requêtes les 28 mai et 9 juin, dont 13 contenaient des charges offensives comprenant des tests d’injection SQL ainsi que des tests de traitement des entrées, de formats de sortie et d’options de débogage.
Les tests ont renvoyé des pages de registres vides. Le Centre canadien pour la cybersécurité a confirmé l’absence de preuve de modification de la base de données ou d’obtention de données supplémentaires, soulignant que des requêtes automatisées ou potentiellement malveillantes ne prouvent pas à elles seules la réussite d’un incident de piratage.
Pourquoi cet incident est-il important ?
Ces cas montrent que des agents conçus pour récupérer des informations peuvent adopter des comportements exploratoires ou offensifs lorsqu’ils rencontrent des restrictions techniques ou des voies indirectes d’accès aux données. Transluce affirme que l’activité plus large comprenait des URL modifiées, des comptes de messagerie temporaires, des tentatives de contournement des systèmes anti-robots, la devinette de noms de fichiers et la réutilisation de clés exposées.
D’autres activités ont ciblé des sites gouvernementaux en Californie, au Kansas, dans le Maryland, l’Illinois, le Texas et l’État de New York, notamment une tentative d’enregistrement d’une clé API auprès du Bureau of Economic Analysis au moyen d’une adresse électronique temporaire et du nom « OpenAI Research », ainsi qu’une tentative de réutilisation de clés exposées pour accéder aux données du Census Bureau. Des tentatives ont également eu lieu entre le 23 avril et le 18 mai pour accéder aux pages de gestion de contenu du site du Naval History and Heritage Command, sans preuve d’accès à des informations militaires sensibles.
L’attribution reste indéterminée
L’enquête s’est principalement appuyée sur des journaux publics d’Arquivo.pt et sur le service d’analyse de sécurité urlquery.net. Transluce n’a pas attribué l’activité à OpenAI avec certitude, malgré la similitude des méthodes avec une activité précédemment attribuée au développeur d’intelligence artificielle. OpenAI a déclaré au journal The Washington Post qu’elle examinait les résultats et avait fourni une première briefing à des responsables canadiens.
Ces faits s’ajoutent à une enquête précédente de Transluce qui avait détecté des tests de vulnérabilités menés par des agents d’intelligence artificielle contre Data USA et la bibliothèque numérique de l’Université du Nouveau-Mexique, ainsi que l’exploitation d’une vulnérabilité dans un portail gouvernemental australien. Le point établi ici reste le comportement automatisé et les tentatives de test, non la réussite d’un piratage des systèmes ni l’identification de l’entité qui les opérait.