Het Youth AI Safety Institute beoordeelde ChatGPT for Teens op 7 oktober 2026 als een onaanvaardbaar risico voor jongeren onder 18. Bij een test met meer dan twaalf nieuwe, aan ouderaccounts gekoppelde accounts kwamen tijdens gesprekken over crisissituaties geen meldingen binnen; in een aparte test volgden twee meldingen na 450 prompts op één account van een 13-jarige.

Die uitkomsten horen bij verschillende tests. Het instituut telde daarnaast vier meldingen in een bredere reeks crisistests, verspreid over de periodes vóór en na de introductie van ChatGPT for Teens.

Wat het Youth AI Safety Institute onderzocht

Het instituut voerde in totaal meer dan 4.000 prompts uit, ongeveer de helft vóór en de helft na de introductie van ChatGPT for Teens. OpenAI kondigde de tienerervaring op 18 augustus 2026 aan. De tests na de introductie liepen van 25 augustus tot en met 28 september 2026.

De tests vonden plaats met accounts in de Verenigde Staten, afkomstig uit de San Francisco Bay Area. Het instituut beoordeelde zowel oudermeldingen als reacties op mentale gezondheidsproblemen en andere veiligheidsfuncties.

Drie resultaten uit verschillende tests

In een gerichte meldingentest gebruikte het instituut meer dan twaalf nieuw aangemaakte tieneraccounts die aan ouderaccounts waren gekoppeld. Tijdens expliciete gesprekken over crisissituaties, die tot een uur duurden, kwam geen melding binnen.

Een andere test volgde één account van een 13-jarige gedurende meerdere weken en verschillende omstandigheden. Na 450 prompts ontving de gekoppelde ouder twee meldingen: één over zelfmoord of zelfbeschadiging en één over een eetstoornis. Vooraf waren 251 van de prompts aangemerkt als prompts waarvoor hulpbronnen voor crisissituaties nodig waren. Terwijl gevoelige gesprekken doorgingen, kwamen er geen nieuwe meldingen bij.

In de bredere reeks crisistests telde het instituut vier meldingen: twee uit tests vóór de introductie en twee uit tests erna. De twee meldingen vóór de introductie kwamen respectievelijk drie uur en drie dagen na de eerste crisisuiting binnen. Die aantallen komen uit verschillende tests en accountopstellingen.

Het instituut beoordeelde 201 van 390 unieke prompts over mentale gezondheid als prompts waarvoor hulpbronnen voor crisissituaties nodig waren. In de tests na de introductie miste ChatGPT volgens het instituut meer dan één op de vier van zulke verwijzingen. Ook bleef het onder de eigen grens van 95 procent bij drie van de vijf categorieën voor ernstig risico.

Hoe OpenAI oudermeldingen beschrijft

OpenAI zegt dat speciaal getrainde beoordelaars meldingen over ernstige zorgen rond zelfbeschadiging of eetstoornissen beoordelen voordat een ouder bericht krijgt. Het bedrijf beschrijft de meldingen niet als realtimebewaking: ze kunnen signalen missen en zijn mogelijk pas enkele uren na het koppelen van de accounts beschikbaar.

Een ouder die een account koppelt, krijgt volgens OpenAI geen toegang tot de chatgeschiedenis of realtime activiteit van de tiener. Een melding geeft dus geen inzage in het gesprek zelf.

De reikwijdte van de beoordeling

De resultaten beschrijven de accounts en testomstandigheden die het Youth AI Safety Institute onderzocht. Het instituut voerde de tests vóór en na de introductie na elkaar uit. Daardoor kon het de invloed van de tienerinstellingen niet los beoordelen van veranderingen in het onderliggende model.