5 października 2026 r. OpenAI zapowiedziało etapowe wdrażanie niewidocznego znaku wodnego textGrain w kwalifikujących się tekstach ChatGPT i Codex w Unii Europejskiej, we wszystkich planach. Polska należy do objętego planem obszaru UE, a wdrażanie miało przebiegać w kolejnych tygodniach.
Osobno OpenAI poinformowało, że od 5 października klienci API na całym świecie mogą dobrowolnie włączyć znak wodny dla wybranych modeli. Ta opcja jest domyślnie wyłączona.
Jak OpenAI opisuje sygnał textGrain
textGrain ma kodować niewidoczny sygnał statystyczny w doborze słów przez model. Nie dodaje widocznej etykiety ani ukrytych znaków — wzorzec ma wynikać ze statystycznych cech tekstu.
OpenAI zapowiedziało początkowo dostęp do detektora dla zatwierdzonych badaczy i organizacji eksperckich. Wnioski o dostęp mają być rozpatrywane indywidualnie.
Wyniki wykrywania OpenAI zależą od warunków testu
W testach fragmentów psychologicznych, przy docelowym odsetku wyników fałszywie dodatnich wynoszącym 1%, OpenAI zgłosiło wykrywanie na poziomie około 80% dla tekstów o długości 200 tokenów i około 95% dla tekstów 400-tokenowych. Token to jednostka tekstu przetwarzana przez model; nie zawsze odpowiada całemu słowu.
Osobna ocena obejmowała angielskie, 400-tokenowe odpowiedzi na pytania ELI5. Wykrywanie wyniosło w niej około 92% przed edycją, 66% po zastąpieniu synonimami 10% słów i 17% po zastąpieniu 25% słów.
| Test | Długość fragmentu i warunek | Wykrywanie zgłoszone przez OpenAI |
| Fragmenty psychologiczne | 200 tokenów; docelowo 1% wyników fałszywie dodatnich | około 80% |
| Fragmenty psychologiczne | 400 tokenów; docelowo 1% wyników fałszywie dodatnich | około 95% |
| Angielskie odpowiedzi na pytania ELI5 | 400 tokenów; bez edycji | około 92% |
| Angielskie odpowiedzi na pytania ELI5 | 400 tokenów; synonimami zastąpiono 10% słów | 66% |
| Angielskie odpowiedzi na pytania ELI5 | 400 tokenów; zastąpiono 25% słów | 17% |
OpenAI podaje, że wykrywanie jest znacznie słabsze w matematyce, gdzie możliwości zmiany doboru słów są ograniczone. Firma informuje też, że w swoich benchmarkach Astra nie odnotowała istotnej różnicy wydajności z textGrain i bez niego.
Wykrycie nie wskazuje, kto napisał tekst
Dodatni wynik oznacza wykrycie sygnału OpenAI w analizowanym tekście. Sam sygnał nie identyfikuje użytkownika, konta, organizacji, promptu ani rozmowy i nie mierzy wkładu człowieka. Nie ustala też autorstwa, własności ani dokładności tekstu.
Brak wykrytego sygnału nie dowodzi, że tekst napisał człowiek. Krótki, edytowany lub przetłumaczony tekst, a także tekst z modelu bez obsługi watermarkingu albo sprzed jego wdrożenia, może nie zawierać wykrywalnego sygnału OpenAI.