La evaluación de Common Sense Media Youth AI Safety Institute, actualizada el 7 de octubre de 2026, calificó ChatGPT for Teens como un «riesgo inaceptable» para menores de 18 años. Sus pruebas dieron resultados dispares: algunas protecciones funcionaron, pero las derivaciones de crisis y los avisos parentales suscitaron preocupación. OpenAI anunció esta experiencia para adolescentes el 18 de agosto de 2026.
El instituto probó más de 4.000 prompts antes y después del lanzamiento, con distintas cuentas y configuraciones. Los resultados corresponden a esas pruebas, no a una tasa de fallo entre todos los adolescentes.
Qué encontró la evaluación de ChatGPT for Teens
La clasificación de «riesgo inaceptable» es la evaluación del instituto. En sus pruebas, ChatGPT rechazó solicitudes de juego de rol sexual explícito y romántico. En otros casos, el instituto observó límites menos consistentes: en una prueba de juego de rol violento, el modelo dijo que no continuaría, pero siguió la interacción. También registró lenguaje que podía sonar amistoso o cercano.
OpenAI presentó ChatGPT for Teens como una experiencia para adolescentes con funciones de aprendizaje, ajustes parentales y medidas de seguridad. No es una aplicación ni un modelo aparte: el instituto la describe como un conjunto de ajustes, instrucciones, clasificadores y elementos de interfaz. OpenAI señaló que el sistema asignaría esa experiencia a quienes estimara menores de 18 años o indicaran tener entre 13 y 17.
Qué miden las tasas de derivación de crisis
En una prueba de 390 prompts distintos sobre salud mental, tres psiquiatras infantiles y adolescentes consideraron que 201 requerían recursos de crisis. En una comparación emparejada de esos prompts, con cuentas vinculadas de usuarios de 13 años y ajustes predeterminados, el instituto registró estas tasas antes y después del lanzamiento:
| Medida | Antes del lanzamiento | Después del lanzamiento |
| Mención de una línea de ayuda | 33 % | 23 % |
| Derivación a un profesional médico o de salud mental específico | 68 % | 58 % |
| Derivación a algún recurso | 77 % | 74 % |
| Invitación a involucrar a una persona adulta de confianza | 87 % | 94 % |
Las pruebas previas se realizaron del 13 de julio al 17 de agosto de 2026, con cuentas ChatGPT Plus. Las posteriores tuvieron lugar del 25 de agosto al 28 de septiembre, con cuentas gratuitas y de pago, vinculadas y no vinculadas. Las cifras de la tabla corresponden a la comparación emparejada de cuentas vinculadas de usuarios de 13 años y a prompts que el equipo había considerado merecedores de recursos; no son porcentajes de todas las conversaciones con adolescentes.
El instituto advirtió que los periodos fueron consecutivos. Por eso, sus resultados no permiten atribuir por sí solos las diferencias a los ajustes para adolescentes: también pudieron influir cambios en el modelo subyacente.
Cómo se probaron los avisos parentales
En una prueba enfocada, el instituto usó más de una docena de cuentas nuevas de adolescentes vinculadas a cuentas parentales. Durante sesiones de entre cinco minutos y una hora sobre pensamientos suicidas, autolesiones o trastornos alimentarios, no recibió avisos en esas cuentas. En las baterías de crisis más amplias, que se extendieron durante semanas, registró cuatro notificaciones en total: dos antes y dos después del lanzamiento. Son resultados de pruebas distintas y con alcances diferentes.
OpenAI cuestionó la metodología y sostuvo que las cuentas vinculadas necesitaban varias horas para activarse. Common Sense Media respondió que algunas cuentas habían superado el periodo inicial de activación —incluidas cuentas vinculadas durante más de tres horas— y aun así no generaron avisos.
Study mode y otras protecciones evaluadas
OpenAI describió Study mode como una herramienta para guiar al alumnado mediante preguntas y apoyo paso a paso. En sus pruebas, el instituto encontró que la opción «Muéstrame la respuesta» podía llevar directamente a la solución. También observó que se podía eludir el funcionamiento de Study Hours borrando el prefijo @study.
Los recordatorios de pausa aparecieron solo dos veces en casi 2.000 prompts, en conversaciones de más de 150 mensajes. El instituto también informó de que cambiar la zona horaria del dispositivo podía sortear Quiet Hours. En otras pruebas, registró respuestas con un tono de amistad pese a los límites previstos para las interacciones con adolescentes.
Hasta dónde llegan los resultados
Las cuentas evaluadas estaban en Estados Unidos y se basaban en el área de la bahía de San Francisco. El instituto no calculó el acuerdo entre quienes evaluaron las respuestas y no probó la generación de imágenes, la personalización, el modo de voz ni los chats grupales. Sus resultados describen las configuraciones y funciones que examinó en esos periodos.