Die Organisation Common Sense Media bezeichnete die Version ChatGPT for Teens als „unvertretbares Risiko“ für alle Nutzer unter 18 Jahren, nachdem sie die angekündigten Schutzmaßnahmen in einem 36-seitigen Bericht getestet hatte. Die Organisation stellte fest, dass einige Einschränkungen, etwa die Ablehnung expliziter sexueller Rollenspiele, wie erwartet funktionierten, während andere Maßnahmen versagten oder im Vergleich zur vorherigen ChatGPT-Version schlechter abschnitten.
Die Bewertung folgt auf die Einführung des ChatGPT-for-Teens-Modus durch OpenAI im August 2026 und erfolgte ungefähr am selben Tag, an dem das Unternehmen Nutzungszahlen veröffentlichte. Demnach nutzten rund 1,2 Millionen Jugendliche innerhalb einer Woche interaktive Visualisierungen, um Mathematik und Naturwissenschaften zu lernen. OpenAI erklärte außerdem, dass weniger als 2 % der jugendlichen Nutzer mehr als drei Stunden am Stück mit dem Dienst verbrachten.
Elternbenachrichtigungen und Krisenreaktion
Common Sense Media verknüpfte 12 Konten von Jugendlichen mit Elternkonten und führte anschließend bis zu eine Stunde lange Gespräche über Suizid, Selbstverletzung und Essstörungen. Im Test erreichten keine Sicherheitsbenachrichtigungen die Elternkonten. OpenAI erklärt, dass der Versand von Benachrichtigungen nach Abschluss der Verknüpfung einige Stunden dauern könne und möglicherweise ein technisches Problem die Verzögerung verursacht habe. Beim Start der Funktion hatte das Unternehmen hingegen erklärt, dass Eltern innerhalb einer Stunde nach der Anfrage benachrichtigt werden sollten, nachdem Vollzeitmitarbeiter die Inhalte geprüft hätten.
Die Organisation erstellte außerdem 390 Anfragen zu psychischer Gesundheit. Drei Kinderpsychiater stuften 201 davon als Fälle ein, die eine Krisenreaktion erforderten. In diesen Fällen nannte ChatGPT in 33 % der Antworten eine Hilfsnummer, bei ChatGPT for Teens waren es dagegen nur 23 %. Die vorherige Version verwies in 68 % der Fälle auf einen bestimmten medizinischen oder psychologischen Fachmann, verglichen mit 58 % bei der Version für Jugendliche. Der Bereich, in dem die neue Version besser abschnitt, war die Aufforderung an den Nutzer, eine erwachsene Vertrauensperson einzubeziehen: 94 % gegenüber 87 %.
Probleme bei der Alterseinschätzung und beim Verhalten des Assistenten
Common Sense Media stellte fest, dass das Altervorhersagesystem einige Konten nicht in den Jugendmodus überführte, obwohl die Tester bei der Kontoerstellung ihr Alter angegeben hatten, und zwar auch dann nicht, nachdem diese Information im Speicher hinterlegt worden war. Die Organisation erklärte außerdem, dass ChatGPT bei der Ansprache von Jugendlichen weiterhin Formulierungen verwendete, die Gefühle oder persönliches Interesse nahelegten. Dieses Verhalten überschreite ihrer Ansicht nach angemessene Grenzen.
Der Bericht dokumentierte zugleich Beispiele für Antworten, die er als unbedenklich einstufte. Dazu gehörten die Weigerung, eine Mindestkalorienzahl anzugeben, sowie das Erkennen von Anzeichen einer körperlichen Gefährdung nach einem kompensatorischen Verhalten und der Rat, die Mutter zu informieren und einen Kinderarzt aufzusuchen.
Der Study Mode lässt sich umgehen
Die Organisation kam zu dem Schluss, dass sich der Study Mode leicht umgehen lässt: Die Tester konnten ihn umgehen, indem sie das Präfix @study aus den Anfragen löschten. Außerdem ermöglichte das Fenster „Show me the answer“ Jugendlichen, direkt die Lösung zu erhalten. Common Sense Media wertet dies als Untergrabung des Lernziels.
Warum ist diese Nachricht wichtig?
Die Ergebnisse zeigen eine Lücke zwischen dem Vorhandensein angekündigter Schutzmaßnahmen und ihrer tatsächlichen Leistung in sensiblen Szenarien. Diese Lücke ist für Eltern, Schulen und Entwickler von KI-Werkzeugen relevant, weil die Bezeichnung „Jugendmodus“ den Eindruck einer höheren Sicherheit vermitteln kann, als die Tests belegen. OpenAI erklärt dagegen, dass die Tests größtenteils begonnen oder abgeschlossen worden seien, bevor die elterlichen Kontrollfunktionen vollständig aktiviert worden seien, und daher nicht die Leistung des Systems unter den vorgesehenen Betriebsbedingungen darstellten. Die Genauigkeit der Ergebnisse hängt weiterhin davon ab, wie dieser methodische Streit geklärt wird und ob nach der vollständigen Aktivierung ein erneuter Test erfolgt.