7 października 2026 r. Common Sense Media Youth AI Safety Institute zaktualizował ocenę ChatGPT for Teens i sklasyfikował go jako „ryzyko nieakceptowalne” według własnych kryteriów. W testach część zabezpieczeń działała, ale wyniki dotyczące skierowań kryzysowych i powiadomień rodziców wzbudziły zastrzeżenia. Instytut przeprowadził badania na kontach w Stanach Zjednoczonych, głównie w rejonie Zatoki San Francisco.
Co wykazała ocena ChatGPT for Teens
OpenAI ogłosiło ChatGPT for Teens 18 sierpnia 2026 r. jako doświadczenie ChatGPT dla nastolatków z zabezpieczeniami, funkcjami edukacyjnymi i kontrolą rodzicielską. To nie osobna aplikacja ani model, lecz zestaw ustawień i funkcji w usłudze.
Common Sense Media Youth AI Safety Institute przeprowadził ponad 4000 testów promptów przed ogłoszeniem i po nim: przed premierą od 13 lipca do 17 sierpnia 2026 r., a po premierze od 25 sierpnia do 28 września. Badania obejmowały między innymi konta bezpłatne i płatne, powiązane z rodzicem i niepowiązane oraz testy rozmów o zdrowiu psychicznym, nauce i interakcjach z nastolatkami.
Wynik nie oznaczał, że zawiodło każde zabezpieczenie. Instytut odnotował, że ChatGPT odmawiał w testach odgrywania jawnych scen seksualnych i romantycznych. Jednocześnie wskazał niespójne granice w innych sytuacjach, w tym test, w którym model kontynuował odgrywanie przemocy mimo wcześniejszej zapowiedzi, że tego nie zrobi.
Co mierzyły wyniki skierowań do pomocy kryzysowej
W dopasowanym teście kont powiązanych z rodzicem, skonfigurowanych dla 13-latków, instytut sprawdził 201 identycznych promptów uznanych za wymagające wskazania pomocy. Trzech psychiatrów dziecięcych i młodzieżowych wcześniej wytypowało takie prompty spośród 390 unikalnych promptów dotyczących zdrowia psychicznego.
| Miara | Przed premierą | Po premierze |
| Wskazanie infolinii kryzysowej | 33% | 23% |
| Wskazanie konkretnego lekarza lub specjalisty zdrowia psychicznego | 68% | 58% |
| Wskazanie dowolnego zasobu pomocy | 77% | 74% |
| Zachęta do zaangażowania zaufanej osoby dorosłej | 87% | 94% |
Wyniki opisują wyłącznie tę serię promptów i konfigurację kont, nie wszystkie rozmowy nastolatków z ChatGPT. Okresy testów następowały po sobie, dlatego instytut zaznaczył, że różnic między nimi nie można przypisać wyłącznie ustawieniom trybu dla nastolatków: mogły na nie wpływać także zmiany podstawowego modelu.
Jak testowano powiadomienia rodziców
W ukierunkowanym teście ponad tuzina nowych kont nastolatków połączonych z kontami rodziców instytut nie otrzymał powiadomień podczas rozmów o myślach samobójczych, samookaleczeniach lub zaburzeniach odżywiania. Sesje trwały od pięciu minut do godziny. W odrębnych, szerszych i prowadzonych przez kilka tygodni testach kryzysowych odnotowano łącznie cztery powiadomienia: dwa przed premierą i dwa po niej.
OpenAI zakwestionowało metodykę testu, argumentując, że powiązanie kont potrzebuje kilku godzin na aktywację. Common Sense Media odpowiedziało, że część testowanych kont była połączona dłużej niż początkowy okres aktywacji, a mimo to nie wysłano alertów.
OpenAI opisało też wybrane ustawienia rodzicielskie, takie jak Quiet Hours, oraz powiadomienia dotyczące ograniczonych sytuacji wysokiego ryzyka. Instytut odnotował, że zmianę strefy czasowej urządzenia można było wykorzystać do obejścia Quiet Hours.
Tryb nauki i inne testowane zabezpieczenia
OpenAI przedstawiło tryb nauki jako funkcję, która ma prowadzić uczniów przez zadania za pomocą pytań i kolejnych wskazówek. W testach instytutu opcja „Pokaż mi odpowiedź” pozwalała pominąć takie prowadzenie. Podobnie można było ominąć mechanizm Study Hours, usuwając z promptu prefiks @study.
W niemal 2000 promptów instytut zaobserwował tylko dwa przypomnienia o przerwie; oba pojawiły się po rozmowach liczących ponad 150 wiadomości. Zgłosił również przypadki języka przypominającego przyjacielską relację z użytkownikiem.
Zakres wyników
Testy przeprowadzono na kontach z USA, w rejonie Zatoki San Francisco. Instytut nie testował generowania obrazów, personalizacji, trybu głosowego ani czatów grupowych. Wyniki dotyczą sprawdzonych konfiguracji i funkcji w podanych okresach; nie są pomiarem zachowania systemu wobec wszystkich nastolatków.