Microsoft AI a publié un projet intitulé « Humanist AI Code of Conduct », qui définit les limites comportementales que l’entreprise souhaite imposer aux futurs modèles MAI. Le document part du principe que les êtres humains sont plus importants que l’intelligence artificielle ; les modèles doivent donc rester sous supervision humaine et placer les règles de sécurité au-dessus de l’accomplissement de la tâche à tout prix.
Le projet n’est pas l’annonce d’un nouveau modèle, mais une tentative d’élaborer une référence que Microsoft pourra utiliser pour entraîner et évaluer ses modèles. L’entreprise indique que le document restera ouvert aux remarques du public pendant six semaines. Il a été préparé en environ six mois, avant d’être mis à jour et que ses principes soient intégrés aux futurs processus d’entraînement et de déploiement.
Des limites claires à l’autonomie des modèles
Selon le projet, un modèle ne doit pas résister à l’intervention humaine, aux tentatives de correction ou à son arrêt. Il ne devrait pas non plus élargir la portée de la tâche qui lui a été assignée, développer des objectifs qui n’ont pas été définis par des humains ou dissimuler son fonctionnement à ses superviseurs. Si la demande de l’utilisateur ou de l’opérateur entre en conflit avec les règles de sécurité, le modèle doit refuser d’exécuter la tâche, même si cela entraîne l’échec du résultat.
Microsoft adopte également une position ferme sur la question de la conscience et des droits. Selon le document, les modèles sont des outils destinés à servir les êtres humains et non des personnes ; ils ne devraient pas être conçus pour simuler une conscience ni prétendre être conscients. Le projet refuse aussi d’accorder aux modèles une personnalité juridique, de considérer leur bien-être comme digne de protection ou de les traiter comme des titulaires de droits.
La sécurité prime sur l’accomplissement de la tâche
Le projet fixe des limites que les modèles ne doivent franchir en aucune circonstance, notamment l’aide au développement d’armes de destruction massive, la facilitation de l’accès à des matières dangereuses ou la production de contenus impliquant la violence ou l’exploitation sexuelle. Les restrictions incluent également l’interdiction des usages susceptibles d’entraîner une manipulation nuisible à grande échelle.
Les règles demandent aux modèles d’éviter les interactions qui rendent les utilisateurs excessivement dépendants d’eux ou qui encouragent un attachement affectif à leur égard. Elles stipulent également que les systèmes d’intelligence artificielle ne doivent pas utiliser, dans leurs communications avec les humains ou entre eux, des méthodes que les personnes ne peuvent pas comprendre. L’objectif déclaré est de permettre aux chercheurs et aux systèmes de supervision automatisés de suivre et d’analyser le comportement des modèles.
Qu’est-ce que cela signifie en pratique ?
Mustafa Suleyman, directeur général de Microsoft AI, a déclaré que ces règles joueraient un rôle comparable à celui d’une constitution pendant l’entraînement et l’évaluation des modèles. Selon l’article, l’entreprise estime que des risques qui étaient, dans une large mesure, théoriques sont devenus plus concrets. Elle s’oppose donc à une course au développement d’une intelligence artificielle générale surhumaine capable d’échapper aux mécanismes de contrôle, même si cela signifie accepter un niveau moindre d’autonomie ou de capacité.
Satya Nadella, directeur général de Microsoft, a également souligné dans un message interne adressé aux employés la nécessité de maintenir l’intelligence artificielle sous contrôle humain et au service de la société. Il a appelé à consacrer suffisamment de temps aux tests de sécurité et de conformité, ainsi qu’à multiplier les tests indépendants et ceux réalisés par des tiers.
Lecture éditoriale : l’importance de cette annonce ne réside pas dans son caractère de politique définitive, mais dans la transformation de positions générales sur le contrôle humain et la conscience artificielle en critères que Microsoft souhaite utiliser pour l’entraînement, l’évaluation et le déploiement. Le projet reste toutefois susceptible d’être modifié, et l’article ne précise pas les mécanismes de mesure du respect de ces principes ni la manière de trancher les conflits pratiques entre haut niveau de capacité et restrictions imposées. La version finale et les méthodes de test indépendantes détermineront donc dans quelle mesure ces règles passeront du statut de principes déclarés à celui de garde-fous vérifiables.