In een verklaring van 30 september 2026 meldde OpenAI dat het een campagne had verstoord die erop gericht was beschermde redenering uit zijn modellen te halen. Het bedrijf schreef een kerncluster toe aan personen met banden met Moonshot AI, de ontwikkelaar van Kimi.

Beschermde redenering is de interne uitwerking waarmee een model een taak aanpakt. OpenAI zegt dat die tussenstappen informatie kunnen bevatten die niet in het uiteindelijke antwoord staat. De gemelde activiteit begon op 1 juli 2026.

Tijdlijn en omvang van de gemelde activiteit

OpenAI zei dat het op 24 en 25 juli pieken zag van 16.000 verzoeken met een relevant extractiepatroon, afkomstig van meer dan 4.000 gebruikers. Het ging om pogingen tot extractie. In een afzonderlijke, bredere groep zag OpenAI verwante promptpatronen bij meer dan 15.000 gebruikers; het bedrijf zei die activiteit uiterlijk 28 juli te hebben verstoord.

DatumDoor OpenAI gemelde gebeurtenis
1 juli 2026De activiteit begon volgens OpenAI op laag volume.
24–25 juli 2026OpenAI meldde pieken met 16.000 extractieverzoeken van meer dan 4.000 gebruikers; het betrof pogingen.
Uiterlijk 28 juli 2026OpenAI zei verwante promptpatroonactiviteit in een groep van meer dan 15.000 gebruikers te hebben verstoord.

Hoe de beschreven extractiepoging werkte

OpenAI beschreef een methode waarbij iemand versleutelde redenering uit het ene gesprek kopieerde en een model in een ander gesprek vroeg die te ontsleutelen en uit te schrijven. Het gaat dus om het manipuleren van modelinteracties. OpenAI zei dat de operators geen encryptie kraakten, geen database compromitteerden en geen opgeslagen gebruikersgesprekken rechtstreeks benaderden.

Eerdere Amerikaanse beschuldigingen over AI-modeldistillatie kwamen aan bod in een eerder NeoTeo-artikel; de juli-campagne die OpenAI beschreef is een afzonderlijke kwestie.

OpenAI’s maatregelen en de reikwijdte van de toeschrijving

OpenAI meldde frauduleuze accounts te hebben geblokkeerd of beperkt, controles bij aanmelding en op infrastructuur te hebben aangescherpt en de monitoring te hebben uitgebreid. Het bedrijf voegde ook bescherming toe tegen het zichtbaar worden van verborgen redenering, waaronder controles om uitvoer tegen te houden die zulke redenering mogelijk blootlegt. Daarnaast deelde OpenAI informatie met branche- en overheidspartners, onder meer via het Frontier Model Forum.

OpenAI zei niet te weten of alle waargenomen operators van één actor afkomstig waren. De toeschrijving gold voor een kerncluster: personen met banden met Moonshot AI.