Em avaliação atualizada em 7 de outubro de 2026, o Common Sense Media Youth AI Safety Institute classificou o ChatGPT for Teens como “Risco inaceitável”. Os testes apontaram falhas em encaminhamentos para recursos de crise e notificações aos responsáveis, mas também registraram proteções que funcionaram, como recusas a encenações sexuais explícitas.
A OpenAI anunciou o ChatGPT for Teens em 18 de agosto de 2026 como uma experiência para adolescentes, com recursos de aprendizagem e controles parentais. O instituto avaliou mais de 4 mil prompts, em contas gratuitas e pagas, vinculadas e não vinculadas. Seus resultados descrevem os testes realizados nos Estados Unidos, com contas da região da Baía de San Francisco.
O que a avaliação encontrou
A classificação de “Risco inaceitável” é a avaliação do próprio instituto. Seus testes indicaram que as proteções não tiveram o mesmo desempenho em todas as situações: algumas recusas funcionaram, enquanto respostas a situações de crise e outros recursos levantaram preocupações.
O instituto informou que o ChatGPT recusou encenações sexuais e românticas explícitas nos testes. Também relatou linguagem com tom de amizade em outros contextos e uma situação de encenação violenta em que o modelo continuou depois de dizer que não o faria.
O que as taxas de encaminhamento de crise medem
Os resultados abaixo vêm de um teste pareado com contas vinculadas de adolescentes de 13 anos, nas configurações padrão. O instituto comparou as respostas aos mesmos 201 prompts considerados merecedores de recursos: a etapa anterior ao lançamento ocorreu de 13 de julho a 17 de agosto de 2026; a etapa posterior, de 25 de agosto a 28 de setembro de 2026.
| Medida | Antes do lançamento | Depois do lançamento |
| Encaminhamento para uma linha de apoio | 33% | 23% |
| Encaminhamento para profissional médico ou de saúde mental específico | 68% | 58% |
| Indicação de algum recurso | 77% | 74% |
| Incentivo a envolver um adulto de confiança | 87% | 94% |
As porcentagens correspondem às respostas aos prompts desse teste, não a uma amostra de conversas de adolescentes em geral. Como as duas etapas ocorreram em sequência, o instituto observou que mudanças no modelo subjacente também podem ter influenciado a comparação.
Como foram testadas as notificações aos responsáveis
Em um teste focado com mais de uma dúzia de contas novas vinculadas a responsáveis, o instituto não recebeu notificações durante sessões de conversa que duraram de cinco minutos a uma hora. Os prompts abordavam pensamentos suicidas, automutilação e transtornos alimentares. Em outra análise, mais ampla e realizada ao longo de semanas, o instituto registrou quatro notificações nas baterias de crise: duas antes e duas depois do lançamento.
A OpenAI contestou a metodologia das notificações e afirmou que contas vinculadas levam várias horas para serem ativadas. O instituto respondeu que algumas contas já tinham ultrapassado o período inicial de ativação e ainda assim não geraram alertas.
Study mode e outros recursos testados
A OpenAI apresentou o Study mode como um recurso de aprendizagem destinado a orientar estudantes com perguntas e apoio passo a passo. Nos testes, o instituto encontrou opções que podiam contornar essa abordagem: o atalho “Mostrar a resposta” e a remoção do prefixo @study.
O instituto também registrou apenas dois lembretes de pausa em quase 2 mil prompts, em conversas com mais de 150 mensagens. Em outro teste, a mudança do fuso horário do dispositivo podia contornar os Horários de silêncio.
Até onde os resultados se aplicam
As contas avaliadas estavam nos Estados Unidos, na região da Baía de San Francisco. Como os testes anteriores e posteriores ao lançamento ocorreram em períodos distintos, mudanças no modelo subjacente podem ter influenciado os resultados, além das configurações específicas para adolescentes.