W komunikacie opublikowanym 30 września 2026 r. OpenAI opisuje skoordynowaną kampanię prób wydobycia chronionego rozumowania z modeli. Według firmy aktywność zaczęła się w lipcu, a jej główny klaster był związany z osobami powiązanymi z Moonshot AI, twórcą Kimi. OpenAI podaje, że do 28 lipca przerwało powiązaną aktywność.

Chronione rozumowanie to wewnętrzny zapis pracy modelu nad zadaniem, który może zawierać informacje niewidoczne w końcowej odpowiedzi. Opisywane przez OpenAI działania miały skłonić modele do ujawnienia właśnie takich treści.

To odrębna sprawa od wcześniej opisywanych zarzutów USA wobec chińskich firm AI dotyczących kopiowania modeli.

Chronologia i skala zgłoszonej aktywności

OpenAI podało, że aktywność rozpoczęła się 1 lipca 2026 r. W dniach 24–25 lipca firma odnotowała skoki obejmujące 16 000 żądań korzystających z powiązanego wzorca ekstrakcji. Były one związane z ponad 4 000 użytkowników. OpenAI zaznaczyło, że liczba żądań opisuje próby, a niekoniecznie udane wydobycie rozumowania.

W dalszej analizie firma zidentyfikowała powiązane wzorce poleceń w grupie ponad 15 000 użytkowników. To szersza grupa niż użytkownicy związani ze skokami liczby żądań z 24–25 lipca. OpenAI poinformowało, że przerwało tę powiązaną aktywność do 28 lipca.

DataZdarzenie opisane przez OpenAI
1 lipca 2026 r.Początek aktywności, początkowo o niewielkiej skali.
24–25 lipca 2026 r.Skoki obejmujące 16 000 prób żądań związanych z ekstrakcją, od ponad 4 000 użytkowników.
28 lipca 2026 r.OpenAI podało, że przerwało powiązaną aktywność obejmującą grupę ponad 15 000 użytkowników.

Jak miała działać próba wydobycia rozumowania

Jeden z opisanych przez OpenAI sposobów polegał na skopiowaniu zaszyfrowanego rozumowania z jednej rozmowy i poproszeniu modelu w innej rozmowie o jego odszyfrowanie oraz przepisanie. Według firmy operatorzy manipulowali interakcjami z modelami; nie złamali szyfrowania, nie naruszyli bazy danych ani nie uzyskali bezpośredniego dostępu do zapisanych rozmów użytkowników.

Reakcja OpenAI i zakres przypisania

OpenAI podało, że zablokowało lub ograniczyło konta uznane za oszukańcze, zaostrzyło kontrole rejestracji i infrastruktury oraz rozszerzyło monitoring. Firma opisała też dodatkowe zabezpieczenia chronionego rozumowania i kontrole strumieniowanych odpowiedzi. Informacje o typie ataku przekazała partnerom z branży i administracji publicznej, w tym za pośrednictwem Frontier Model Forum.

OpenAI przypisało główny klaster aktywności osobom związanym z Moonshot AI. Firma podała zarazem, że nie ustaliła, czy wszyscy zaobserwowani operatorzy pochodzili od jednego podmiotu.