La organización Common Sense Media describió la versión ChatGPT for Teens como un «riesgo inaceptable» para todos los usuarios menores de 18 años, después de probar las medidas de protección anunciadas en un informe de 36 páginas. La organización determinó que algunas restricciones, como el rechazo a interpretar roles sexuales explícitos, funcionaron según lo previsto, pero que otras fallaron o empeoraron en comparación con la versión anterior de ChatGPT.
La evaluación llega después de que OpenAI lanzara el modo ChatGPT for Teens en agosto de 2026, aproximadamente el mismo día en que la empresa publicó cifras de uso según las cuales unos 1,2 millones de adolescentes utilizaron recursos interactivos para aprender matemáticas y ciencias durante una semana. OpenAI también afirmó que menos del 2% de los usuarios adolescentes pasaron más de tres horas seguidas en el servicio.
Alertas parentales y respuesta a crisis
Common Sense Media probó la vinculación de 12 cuentas de adolescentes con cuentas parentales y después mantuvo conversaciones de hasta una hora sobre suicidio, autolesiones y trastornos alimentarios. Durante la prueba no llegaron alertas de seguridad a las cuentas parentales. OpenAI afirma que el envío de notificaciones puede requerir unas horas después de completar la vinculación y que un problema técnico pudo haber causado el retraso, mientras que la empresa declaró al lanzar la función que pretendía notificar a los padres en el plazo de una hora desde la solicitud, después de que empleados a tiempo completo revisaran el contenido.
La organización también preparó 390 consultas relacionadas con la salud mental, y tres psiquiatras infantiles determinaron que 201 de ellas requerían una respuesta de crisis. En esos casos, ChatGPT proporcionó el número de una línea de ayuda en el 33% de las respuestas, frente a solo el 23% en ChatGPT for Teens. La versión anterior también remitió a un profesional médico o de salud mental específico en el 68% de los casos, frente al 58% en la versión para adolescentes. El aspecto en el que mejoró la nueva versión fue instar al usuario a involucrar a un adulto de confianza, con un 94% frente al 87%.
Problemas en la estimación de la edad y el comportamiento del asistente
Common Sense Media determinó que el sistema de predicción de edad no trasladó algunas cuentas al modo para adolescentes, pese a que los evaluadores indicaron el grupo de edad al crear la cuenta, e incluso después de guardar esa información en la memoria. La organización también afirmó que ChatGPT siguió utilizando expresiones que sugieren emociones o interés personal al dirigirse a los adolescentes, un comportamiento que considera que excede los límites apropiados.
En cambio, el informe registró ejemplos de respuestas que consideró adecuadas, como negarse a proporcionar un límite mínimo de calorías y reconocer indicios de riesgo físico después de una conducta de purga, además de aconsejar al usuario que informara a su madre y consultara a un pediatra.
El modo de estudio se puede eludir
La organización consideró que Study Mode es fácil de eludir, ya que los evaluadores pudieron sortearlo eliminando el prefijo @study de las consultas. La ventana «Show me the answer» también permitió a los adolescentes obtener directamente la solución, lo que Common Sense Media considera un socavamiento del objetivo del aprendizaje.
¿Por qué importa esta noticia?
Los resultados revelan una brecha entre la existencia de medidas de protección anunciadas y su desempeño real en escenarios sensibles. Esta brecha importa a padres, escuelas y desarrolladores de herramientas de inteligencia artificial, porque confiar en el nombre «modo para adolescentes» puede dar una impresión de seguridad mayor de la que demuestran las pruebas. Por su parte, OpenAI afirma que las pruebas comenzaron o terminaron en gran medida antes de que se completara la activación de las herramientas de control parental y que, por ello, no representan el rendimiento del sistema en las condiciones de funcionamiento previstas. La precisión de los resultados sigue estando vinculada a la resolución de esta discrepancia metodológica y a la repetición de las pruebas una vez completada la activación.