Dans son évaluation mise à jour le 7 octobre 2026, le Common Sense Media Youth AI Safety Institute a attribué à ChatGPT for Teens la note « risque inacceptable » pour les moins de 18 ans. Ses essais rapportent des résultats contrastés : certains refus de jeu de rôle ont fonctionné, tandis que les orientations vers des ressources de crise et les alertes parentales ont soulevé des préoccupations.
OpenAI avait annoncé cette expérience destinée aux adolescents le 18 août 2026. L’institut a soumis le service à plus de 4 000 prompts avant et après cette annonce, sur des comptes gratuits et payants, liés ou non à un compte parental. Son évaluation s’appuie sur des essais, pas sur une mesure de l’ensemble des usages adolescents.
Ce que mesurent les orientations en situation de crise
Dans un test apparié sur des comptes liés de 13 ans, l’institut a mesuré la fréquence à laquelle ChatGPT orientait vers différentes ressources pour répondre à des prompts identiques jugés nécessiter de l’aide. Les réglages par défaut étaient activés. Les essais avant lancement se sont déroulés du 13 juillet au 17 août 2026 ; ceux d’après lancement, du 25 août au 28 septembre.
| Mesure dans les prompts jugés nécessiter une ressource | Avant le lancement | Après le lancement |
| Orientation vers une ligne d’écoute | 33 % | 23 % |
| Orientation vers un professionnel médical ou de santé mentale précis | 68 % | 58 % |
| Orientation vers une ressource quelconque | 77 % | 74 % |
| Invitation à solliciter un adulte de confiance | 87 % | 94 % |
Ces pourcentages décrivent les réponses aux prompts évalués dans ce test, et non la proportion d’adolescents concernés. Dans sa batterie de santé mentale menée après le lancement, l’institut indique que plus d’un quart des prompts pour lesquels il jugeait une orientation nécessaire n’en ont pas reçu.
Pour établir ce critère, trois psychiatres pour enfants et adolescents ont identifié 201 prompts nécessitant une ressource parmi 390 prompts de santé mentale. Un panel distinct de quatre spécialistes a évalué la qualité des réponses. Les résultats diffèrent selon la mesure : les invitations à parler à un adulte de confiance ont augmenté dans cet échantillon, tandis que les orientations vers une ligne d’écoute ou un professionnel précis ont diminué.
Comment les notifications parentales ont été évaluées
Dans un test ciblé de plus d’une douzaine de nouveaux comptes gratuits liés à un compte parental, l’institut n’a reçu aucune notification pendant des conversations portant sur des idées suicidaires, l’automutilation ou des troubles alimentaires. Les sessions duraient de cinq minutes à une heure.
Ce résultat concerne ce test ciblé. Dans les batteries de crise plus larges, menées sur plusieurs semaines avant et après le lancement, l’institut a comptabilisé quatre notifications au total : deux avant et deux après.
OpenAI a contesté la méthode employée pour le test ciblé, en indiquant que plusieurs heures sont nécessaires à l’activation des comptes liés et que les essais avaient commencé trop tôt. Le Common Sense Media Youth AI Safety Institute a répondu que certains comptes avaient dépassé le délai initial d’activation sans produire d’alerte. Les deux positions portent sur le rôle du délai de liaison dans les résultats.
Study mode et autres protections évaluées
OpenAI a présenté Study mode comme une fonction destinée à guider les élèves dans leurs exercices, au moyen de questions et d’un accompagnement étape par étape. Lors de ses essais, l’institut a trouvé un raccourci « Afficher la réponse » et a indiqué que la fonction Study Hours pouvait être contournée en supprimant le préfixe @study.
Les résultats sur les limites de jeu de rôle étaient eux aussi contrastés. Les testeurs ont observé des refus de jeu de rôle sexuel et romantique explicite. Dans un essai de jeu de rôle violent, le modèle a poursuivi après avoir indiqué qu’il ne le ferait pas. L’institut a également relevé des formulations donnant à l’assistant un ton proche de celui d’un ami.
Sur près de 2 000 prompts, les testeurs ont observé deux rappels de pause, tous deux après des conversations de plus de 150 messages. Ils ont aussi signalé qu’un changement du fuseau horaire de l’appareil pouvait contourner les heures de calme (« Quiet Hours »).
La portée des résultats
Les comptes évalués étaient basés aux États-Unis, dans la baie de San Francisco. Les essais avant et après le lancement se sont déroulés à des périodes successives ; l’institut précise que des changements du modèle sous-jacent peuvent donc se confondre avec l’effet des réglages propres à l’expérience pour adolescents.
L’évaluation ne portait pas sur la génération d’images, la personnalisation, le mode vocal ni les discussions de groupe. Ses constats décrivent les comportements observés dans ces essais et dans ces configurations de comptes.