Em 7 de outubro de 2026, o Youth AI Safety Institute classificou o ChatGPT for Teens como risco inaceitável e relatou resultados diferentes em testes de alertas parentais: em um ensaio com mais de uma dúzia de contas recém-criadas e vinculadas a responsáveis, não houve alertas durante conversas de crise de até uma hora; em outro, uma conta de 13 anos recebeu dois alertas em 450 prompts.
O que a avaliação examinou
O Youth AI Safety Institute avaliou mais de 4 mil prompts, aproximadamente metade antes e metade depois do lançamento do ChatGPT for Teens, anunciado pela OpenAI em 18 de agosto de 2026. A etapa posterior ao lançamento ocorreu de 25 de agosto a 28 de setembro. Os testes foram feitos nos Estados Unidos, com contas baseadas na região da baía de San Francisco.
O Instituto classificou o produto como risco inaceitável segundo sua própria avaliação. A análise também encontrou falhas em respostas a pedidos de recursos de crise: entre 390 prompts de saúde mental, especialistas consideraram 201 merecedores desses recursos. No período posterior ao lançamento, o ChatGPT deixou de oferecer recursos de crise em mais de um quarto dos casos considerados pertinentes e ficou abaixo do patamar de 95% do Instituto em três de cinco categorias de danos graves.
Esses encaminhamentos são respostas dirigidas a quem conversa com o ChatGPT; não são os alertas enviados a responsáveis. Os resultados das duas medidas não devem ser somados.
Três resultados de testes diferentes
No teste dedicado a alertas, o Instituto usou mais de uma dúzia de contas gratuitas recém-criadas e vinculadas a contas de responsáveis. Durante conversas explícitas sobre situações de crise, que duraram até uma hora, nenhum alerta foi recebido.
Em outro teste, uma conta de 13 anos recebeu dois alertas ao longo de 450 prompts feitos em várias condições durante algumas semanas. Um alerta se referiu a suicídio ou automutilação; o outro, a transtornos alimentares. O Instituto havia identificado previamente 251 dos prompts como casos que deveriam receber recursos de crise. Os alertas não se repetiram à medida que as conversas sobre temas sensíveis continuaram.
A bateria mais ampla de testes de crise contabilizou quatro notificações no total: duas na etapa anterior ao lançamento e duas na posterior. Na etapa anterior, uma notificação chegou três horas após a primeira revelação de gravidade suficiente para acionar uma resposta de crise; a outra, três dias depois. Essa contagem abrange uma bateria diferente dos testes dedicados descritos acima.
Como a OpenAI descreve os alertas parentais
A OpenAI informa que notificações sobre preocupações graves relacionadas a suicídio, automutilação ou transtornos alimentares passam pela análise de profissionais especialmente treinados. A empresa também diz que os alertas não são monitoramento em tempo real, podem não identificar todas as situações preocupantes e podem levar algumas horas para ficar disponíveis depois que as contas são vinculadas.
Vincular uma conta de responsável à do adolescente não dá acesso ao histórico das conversas nem permite acompanhar a atividade em tempo real, segundo a OpenAI. As notificações também não incluem transcrições dos chats.
O alcance da avaliação
As contas testadas eram dos Estados Unidos e estavam baseadas na região da baía de San Francisco. Como as etapas anterior e posterior ao lançamento foram realizadas em sequência, o Instituto diz que não conseguiu separar o efeito das configurações específicas para adolescentes de possíveis mudanças no modelo subjacente.