Il 30 settembre 2026 OpenAI ha riferito di aver individuato e interrotto una campagna che mirava a rendere visibile il ragionamento protetto dei suoi modelli. L’attività, secondo l’azienda, era iniziata a luglio; OpenAI ha attribuito un nucleo a persone associate a Moonshot AI, sviluppatrice di Kimi.

OpenAI riferisce una campagna contro il ragionamento protetto

OpenAI chiama ragionamento protetto il processo interno con cui un modello elabora un compito, che può contenere informazioni non presenti nella risposta finale. L’azienda ha descritto tentativi di far emergere questo contenuto manipolando le interazioni con i modelli.

Cronologia e dimensioni dell’attività riferita

OpenAI ha collocato l’inizio dell’attività al 1° luglio 2026. I picchi del 24 e 25 luglio hanno coinvolto 16.000 richieste basate su uno schema di estrazione e oltre 4.000 utenti. L’azienda ha precisato che il dato riguarda i tentativi, non il numero di estrazioni riuscite.

In un gruppo più ampio, OpenAI ha individuato schemi di prompt correlati che coinvolgevano oltre 15.000 utenti. Ha detto di aver interrotto questa attività entro il 28 luglio.

DataAttività riferita da OpenAI
1° luglio 2026L’attività è iniziata a basso volume.
24–25 luglio 2026Picchi di 16.000 richieste tentate, associate a oltre 4.000 utenti.
Entro il 28 luglio 2026OpenAI ha interrotto attività correlata in un gruppo di oltre 15.000 utenti.

La tecnica descritta da OpenAI

Un approccio riferito da OpenAI consisteva nel copiare il ragionamento cifrato da una conversazione e chiedere a un modello, in un’altra conversazione, di decifrarlo e trascriverlo. In questo modo, il tentativo passava attraverso le risposte del modello: OpenAI ha detto che non sono state violate la cifratura o una banca dati e che gli operatori non hanno avuto accesso diretto alle conversazioni archiviate.

Le misure adottate e la portata dell’attribuzione

OpenAI ha detto di aver bannato o limitato account fraudolenti, rafforzato i controlli in fase di registrazione e sull’infrastruttura, ampliato il monitoraggio e introdotto ulteriori protezioni per il ragionamento nascosto. Ha inoltre riferito di aver condiviso informazioni sull’attività con partner del settore e istituzionali.

L’attribuzione di OpenAI riguarda un nucleo dell’attività: persone associate a Moonshot AI. L’azienda ha aggiunto che non era chiaro se tutti gli operatori individuati provenissero da un unico soggetto. Il caso rientra nel più ampio dibattito sulla distillazione dei modelli, già affrontato da NeoTeo in un precedente approfondimento sulle accuse statunitensi.