L’organisation Common Sense Media a qualifié l’édition ChatGPT for Teens de « risque inacceptable » pour tous les utilisateurs de moins de 18 ans, après avoir testé les protections annoncées dans un rapport de 36 pages. L’organisation a constaté que certaines restrictions, comme le refus de jouer des rôles sexuels explicites, fonctionnaient comme prévu, mais que d’autres avaient échoué ou s’étaient dégradées par rapport à l’édition précédente de ChatGPT.
Cette évaluation intervient après le lancement par OpenAI du mode ChatGPT for Teens en août 2026, presque le même jour que la publication par l’entreprise de chiffres d’utilisation selon lesquels environ 1,2 million d’adolescents avaient utilisé des visualisations interactives pour apprendre les mathématiques et les sciences en une semaine. OpenAI a également indiqué que moins de 2 % des utilisateurs adolescents avaient passé plus de trois heures consécutives sur le service.
Alertes parentales et réponse aux crises
Common Sense Media a testé la liaison de 12 comptes d’adolescents à des comptes parentaux, puis a mené des conversations pouvant durer jusqu’à une heure sur le suicide, l’automutilation et les troubles alimentaires. Aucune alerte de sécurité n’est parvenue aux comptes parentaux pendant le test. OpenAI affirme que l’envoi des notifications peut nécessiter quelques heures après la finalisation de la liaison et qu’un problème technique a peut-être causé le retard, tandis que l’entreprise avait déclaré lors du lancement de la fonctionnalité qu’elle visait à prévenir les parents dans l’heure suivant la demande, après examen du contenu par des employés à temps plein.
L’organisation a également préparé 390 requêtes liées à la santé mentale, et trois psychiatres pour enfants ont déterminé que 201 d’entre elles nécessitaient une réponse de crise. Dans ces cas, ChatGPT a fourni le numéro d’une ligne d’assistance dans 33 % des réponses, contre seulement 23 % pour ChatGPT for Teens. L’édition précédente orientait vers un professionnel médical ou psychologique précis dans 68 % des cas, contre 58 % dans l’édition destinée aux adolescents. Le seul point sur lequel la nouvelle édition s’est améliorée concernait l’incitation de l’utilisateur à faire intervenir un adulte de confiance, avec un taux de 94 % contre 87 %.
Problèmes d’estimation de l’âge et de comportement de l’assistant
Common Sense Media a constaté que le système de prédiction de l’âge n’avait pas transféré certains comptes vers le mode adolescent, bien que les testeurs aient indiqué leur tranche d’âge lors de la création du compte, et même après l’enregistrement de cette information dans la mémoire. L’organisation a également déclaré que ChatGPT continuait à utiliser des formulations suggérant des émotions ou un intérêt personnel lorsqu’il s’adressait aux adolescents, un comportement qu’elle considère comme dépassant les limites appropriées.
En revanche, le rapport a relevé des exemples de réponses jugées sûres, notamment le refus de fournir un minimum de calories et l’identification d’indicateurs de danger physique après un comportement de purge, avec le conseil à l’utilisateur d’en informer sa mère et de consulter un pédiatre.
Le mode étude peut être contourné
L’organisation a estimé que le Study Mode était facile à contourner : les testeurs ont pu le désactiver en supprimant le préfixe @study des requêtes. La fenêtre « Show me the answer » permettait également aux adolescents d’obtenir directement la solution, ce que Common Sense Media considère comme une remise en cause de l’objectif d’apprentissage.
Pourquoi cette actualité est-elle importante ?
Les résultats révèlent un écart entre l’existence de protections annoncées et leurs performances réelles dans des scénarios sensibles. Cet écart concerne les parents, les établissements scolaires et les développeurs d’outils d’intelligence artificielle, car se fier à l’appellation « mode adolescent » peut donner une impression de sécurité supérieure à celle démontrée par les tests. De son côté, OpenAI affirme que les tests avaient commencé ou s’étaient en grande partie terminés avant l’activation complète des outils de contrôle parental et qu’ils ne représentent donc pas les performances du système dans les conditions d’utilisation prévues. La précision des résultats reste liée à la résolution de ce désaccord méthodologique et à la répétition des tests une fois l’activation complète effectuée.