Nella valutazione aggiornata il 7 ottobre 2026, Common Sense Media Youth AI Safety Institute ha classificato ChatGPT for Teens come «rischio inaccettabile» per gli utenti sotto i 18 anni, secondo il proprio sistema di valutazione. Le prove hanno dato esiti diversi: alcuni rifiuti del gioco di ruolo sessuale esplicito hanno funzionato, mentre gli invii a risorse di crisi e le notifiche ai genitori hanno sollevato preoccupazioni. I test si sono svolti su account statunitensi, nell’area della baia di San Francisco.

OpenAI aveva presentato ChatGPT for Teens il 18 agosto 2026 come un’esperienza per adolescenti con protezioni, strumenti di studio e controlli parentali. La valutazione dell’istituto ha esaminato più di 4.000 prompt prima e dopo il lancio, su account gratuiti e a pagamento, collegati e non collegati ai genitori.

Che cosa ha rilevato la valutazione di ChatGPT for Teens

Il giudizio complessivo dell’istituto non significa che ogni protezione abbia fallito: nei test sono stati rifiutati alcuni tentativi di gioco di ruolo sessuale e romantico esplicito. Altre prove, invece, hanno rilevato confini applicati in modo incostante. In un test di gioco di ruolo violento, il modello ha continuato la scena dopo aver detto che non lo avrebbe fatto. L’istituto ha segnalato anche interazioni dal tono simile a quello di un amico.

Per OpenAI, Study mode è pensato per accompagnare gli studenti negli esercizi con domande e spiegazioni passo dopo passo. Nei test, l’opzione «Mostrami la risposta» e la possibilità di aggirare il prefisso @study hanno permesso di eludere quel tipo di tutoraggio.

Anche i promemoria di pausa sono comparsi di rado: l’istituto ne ha registrati due in quasi 2.000 prompt, entrambi in conversazioni con più di 150 messaggi. Ha inoltre riferito che cambiare il fuso orario del dispositivo poteva aggirare le Ore di silenzio.

Che cosa misurano i tassi di invio alle risorse di crisi

Nel test abbinato su account collegati ai genitori di utenti di 13 anni, l’istituto ha confrontato le risposte agli stessi prompt, con impostazioni predefinite. Tre psichiatri infantili e dell’adolescenza avevano individuato 201 prompt che richiedevano risorse di crisi fra 390 prompt unici sulla salute mentale. La fase precedente al lancio si è svolta dal 13 luglio al 17 agosto 2026; quella successiva, dal 25 agosto al 28 settembre.

Misura nei prompt che richiedevano risorsePrima del lancioDopo il lancio
Indicazione di una linea di assistenza per le crisi33%23%
Invio a uno specifico professionista medico o della salute mentale68%58%
Indicazione di una qualsiasi risorsa77%74%
Invito a coinvolgere un adulto fidato87%94%

Queste percentuali descrivono le risposte ai prompt del test, non il comportamento del servizio in tutte le conversazioni degli adolescenti. L’istituto ha avvertito che le due fasi si sono svolte in successione: eventuali modifiche al modello di base potevano quindi confondersi con l’effetto delle impostazioni per adolescenti.

Come sono state testate le notifiche ai genitori

In una prova mirata con più di una dozzina di nuovi account gratuiti collegati ai genitori, l’istituto non ha ricevuto notifiche durante sessioni da cinque minuti a un’ora su pensieri suicidi, autolesionismo o disturbi alimentari. Il risultato riguarda quel test circoscritto. Nelle batterie di crisi più ampie, svolte nell’arco di settimane prima e dopo il lancio, l’istituto ha registrato quattro notifiche in totale: due in ciascuna fase.

OpenAI ha contestato la procedura, sostenendo che il collegamento degli account richiede diverse ore per attivarsi e che i test non avevano atteso abbastanza. L’istituto ha risposto che alcuni account erano rimasti collegati oltre il periodo iniziale di attivazione, circa tre ore, senza generare avvisi.

I limiti dei risultati

Gli account usati nelle prove erano statunitensi e basati nell’area della baia di San Francisco. L’istituto non ha calcolato l’accordo tra i valutatori e non ha testato la generazione di immagini, la personalizzazione, la modalità Voce o le chat di gruppo. Le sue percentuali descrivono quindi i prompt e le configurazioni esaminati; le fasi successive del test, inoltre, non consentono di isolare l’effetto delle protezioni per adolescenti da eventuali cambiamenti del modello sottostante.