Anthropic a révélé que plusieurs acteurs malveillants avaient détourné le modèle Claude pour mener plus rapidement des opérations de piratage, collecter des secrets et développer des logiciels malveillants, au cours de la période allant de décembre 2025 à août 2026. Ces activités comprenaient des groupes motivés par des considérations financières et d’autres liés à l’espionnage, ainsi que des opérations de fraude, d’influence, de surveillance, de développement d’armes et de modèles d’intelligence artificielle dérivés.
L’un des cas était lié à un membre supposé francophone du groupe ShinyHunters, utilisant le pseudonyme « frkoo ». L’attaquant a exécuté un pipeline sur dix travailleurs AWS EC2 afin de télécharger 1,8 million de paquets APK distincts depuis plusieurs boutiques d’applications, puis de les désassembler et de les analyser à la recherche de secrets intégrés au moyen de l’outil TruffleHog. Les résultats vérifiés étaient envoyés en temps réel à un groupe Telegram, organisé selon plus de 100 types de codes sources ou de secrets.
Le même acteur a utilisé un autre processus automatisé pour collecter les adresses e-mail d’organisations sur GitHub, puis les exploiter afin d’obtenir des jetons d’accès personnels GitHub PATs. Selon Anthropic, ces deux opérations ont fourni les identifiants initiaux utilisés dans la plupart des compromissions confirmées attribuées à l’attaquant. Il a également créé une boutique de cartes bancaires sous le nom policenationale[.]cc, usurpant l’identité de la Police nationale française pour vendre des relevés de cartes de paiement, des données de leurs titulaires et des cartes interactives indiquant les adresses des victimes.
Des attaques plus rapides et plus vastes
Anthropic affirme que Claude a aidé l’un des attaquants attribués à ShinyHunters à extraire des données d’authentification et à obtenir plus de 2 100 ensembles de jetons Azure AD associés à plus de 40 locataires d’entreprise dans Microsoft, en environ 34 heures. Selon l’entreprise, les agents d’intelligence artificielle ont effectué la majeure partie du travail. Dans d’autres cas, les attaquants sont passés d’un jeton de développeur volé à un contrôle administratif complet en moins de trois heures ; un téraoctet de données a également été dérobé à un fournisseur technologique, tandis qu’une compagnie aérienne et une entreprise énergétique ont été compromises.
Le rapport fait également état d’activités attribuées au groupe russe Midnight Blizzard, qui a utilisé Claude pour automatiser le développement de logiciels malveillants, la reconnaissance, l’achat d’infrastructures, l’hameçonnage, l’établissement et le maintien de l’accès, le contrôle et la commande, ainsi que l’exfiltration de données. Le groupe a aussi créé un mécanisme de rétroaction reconstruisant les logiciels malveillants lorsqu’ils étaient détectés par des produits de sécurité, et a ciblé plus de 20 entités gouvernementales, de défense, diplomatiques, de renseignement et de politique étrangère.
Quant au groupe sinophone GTG-10007, il a utilisé Claude comme couche d’ingénierie et de coordination pour un programme offensif comprenant la reconnaissance de réseaux gouvernementaux au Moyen-Orient, en Europe et en Asie du Sud-Est, la recherche de vulnérabilités et le développement d’exploits contre des produits de sécurité, ainsi que la création de logiciels malveillants et d’une plateforme de collecte d’informations. Anthropic affirme que ces opérations ont révélé des vulnérabilités auparavant inconnues dans un produit de sécurité et développé des exploits fonctionnels pour plusieurs familles d’équipements réseau et de sécurité, en ciblant environ 50 organisations dans différents secteurs.
Qu’est-ce qui change concrètement ?
Les faits montrent que le risque ne se limite pas à l’utilisation d’un modèle de langage pour écrire du code, mais s’étend à son intégration dans des chaînes de travail automatisées qui exécutent la reconnaissance, le tri, le développement et l’attaque avec une intervention humaine limitée. Cela réduit le temps de réaction des équipes de défense, notamment lorsqu’un seul identifiant devient le point de départ d’une prise de contrôle d’environnements étendus.
Anthropic a indiqué avoir interrompu l’utilisation de Claude dans ces activités, banni les comptes qui y étaient associés, ajusté ses contrôles de sécurité et ajouté des moyens de détecter plus rapidement les abus, tout en alertant les autorités, les partenaires industriels et les victimes. Le rapport ne permet pas à lui seul de déterminer dans quelle mesure chaque opération dépendait de Claude par rapport à d’autres outils, mais il montre que l’intégration du modèle dans un flux de travail offensif structuré est devenue un facteur concret d’accélération et d’élargissement des compromissions.