Il 7 ottobre 2026 il Youth AI Safety Institute ha classificato ChatGPT for Teens come «rischio inaccettabile» e ha riferito esiti diversi in prove distinte sulle notifiche ai genitori: nessun avviso in un test con oltre una dozzina di account collegati e due in un’altra prova su 450 prompt.

Che cosa ha valutato il Youth AI Safety Institute

L’Istituto ha esaminato più di 4.000 prompt in due periodi, prima e dopo il lancio di ChatGPT for Teens, annunciato da OpenAI il 18 agosto 2026. Circa metà dei prompt è stata esaminata in ciascun periodo. Le prove successive al lancio si sono svolte dal 25 agosto al 28 settembre 2026.

Per valutare le risposte ai temi di salute mentale, gli esperti hanno individuato 201 prompt su 390 che avrebbero dovuto ricevere risorse di crisi. Nel periodo successivo al lancio, il sistema non ha fornito tali indicazioni in più di un quarto dei casi considerati meritevoli di un rinvio. L’Istituto ha inoltre rilevato risultati inferiori alla propria soglia del 95% in tre delle cinque categorie di danno grave esaminate.

Tre risultati da prove diverse

Le prove sulle notifiche ai genitori hanno riguardato account e condizioni differenti.

In un test dedicato, oltre una dozzina di account appena creati e collegati ai genitori non ha ricevuto notifiche durante conversazioni esplicite su situazioni di crisi, alcune durate fino a un’ora.

In una prova post-lancio distinta, un account impostato sull’età di 13 anni ha ricevuto due notifiche nel corso di 450 prompt, distribuiti su diverse condizioni e su più settimane. Gli esperti avevano giudicato 251 di quei prompt meritevoli di risorse di crisi. Una notifica riguardava il suicidio o l’autolesionismo, l’altra i disturbi alimentari; gli avvisi non si sono ripetuti mentre proseguivano le conversazioni su temi sensibili.

Nel dato complessivo delle batterie di test sulle crisi, svolte prima e dopo il lancio, l’Istituto ha contato quattro notifiche: due in ciascun periodo.

Come OpenAI descrive le notifiche ai genitori

OpenAI afferma che le notifiche vengono inviate dopo una valutazione da parte di personale appositamente formato. L’azienda precisa che non si tratta di un monitoraggio in tempo reale e che il sistema può non rilevare ogni situazione. Dopo aver collegato gli account, le notifiche possono richiedere fino a qualche ora per diventare disponibili.

Il collegamento degli account non permette al genitore di leggere la cronologia delle chat o di vedere in tempo reale l’attività dell’adolescente. Gli avvisi, quindi, non offrono accesso continuo alle conversazioni.

Il perimetro della valutazione

I test dell’Istituto hanno riguardato account statunitensi basati nell’area della Baia di San Francisco. Le prove prima e dopo il lancio si sono svolte in sequenza: per questo l’Istituto non ha potuto separare gli effetti delle impostazioni per adolescenti dai cambiamenti del modello sottostante.