W komunikacie opublikowanym 30 września 2026 r. OpenAI opisuje skoordynowaną kampanię prób wydobycia chronionego rozumowania z modeli. Według firmy aktywność zaczęła się w lipcu, a jej główny klaster był związany z osobami powiązanymi z Moonshot AI, twórcą Kimi. OpenAI podaje, że do 28 lipca przerwało powiązaną aktywność.
Chronione rozumowanie to wewnętrzny zapis pracy modelu nad zadaniem, który może zawierać informacje niewidoczne w końcowej odpowiedzi. Opisywane przez OpenAI działania miały skłonić modele do ujawnienia właśnie takich treści.
To odrębna sprawa od wcześniej opisywanych zarzutów USA wobec chińskich firm AI dotyczących kopiowania modeli.
Chronologia i skala zgłoszonej aktywności
OpenAI podało, że aktywność rozpoczęła się 1 lipca 2026 r. W dniach 24–25 lipca firma odnotowała skoki obejmujące 16 000 żądań korzystających z powiązanego wzorca ekstrakcji. Były one związane z ponad 4 000 użytkowników. OpenAI zaznaczyło, że liczba żądań opisuje próby, a niekoniecznie udane wydobycie rozumowania.
W dalszej analizie firma zidentyfikowała powiązane wzorce poleceń w grupie ponad 15 000 użytkowników. To szersza grupa niż użytkownicy związani ze skokami liczby żądań z 24–25 lipca. OpenAI poinformowało, że przerwało tę powiązaną aktywność do 28 lipca.
| Data | Zdarzenie opisane przez OpenAI |
| 1 lipca 2026 r. | Początek aktywności, początkowo o niewielkiej skali. |
| 24–25 lipca 2026 r. | Skoki obejmujące 16 000 prób żądań związanych z ekstrakcją, od ponad 4 000 użytkowników. |
| 28 lipca 2026 r. | OpenAI podało, że przerwało powiązaną aktywność obejmującą grupę ponad 15 000 użytkowników. |
Jak miała działać próba wydobycia rozumowania
Jeden z opisanych przez OpenAI sposobów polegał na skopiowaniu zaszyfrowanego rozumowania z jednej rozmowy i poproszeniu modelu w innej rozmowie o jego odszyfrowanie oraz przepisanie. Według firmy operatorzy manipulowali interakcjami z modelami; nie złamali szyfrowania, nie naruszyli bazy danych ani nie uzyskali bezpośredniego dostępu do zapisanych rozmów użytkowników.
Reakcja OpenAI i zakres przypisania
OpenAI podało, że zablokowało lub ograniczyło konta uznane za oszukańcze, zaostrzyło kontrole rejestracji i infrastruktury oraz rozszerzyło monitoring. Firma opisała też dodatkowe zabezpieczenia chronionego rozumowania i kontrole strumieniowanych odpowiedzi. Informacje o typie ataku przekazała partnerom z branży i administracji publicznej, w tym za pośrednictwem Frontier Model Forum.
OpenAI przypisało główny klaster aktywności osobom związanym z Moonshot AI. Firma podała zarazem, że nie ustaliła, czy wszyscy zaobserwowani operatorzy pochodzili od jednego podmiotu.