Ce 30 septembre 2026, OpenAI déclare avoir identifié et interrompu une campagne qui cherchait, selon l’entreprise, à faire révéler par ses modèles leur raisonnement protégé. OpenAI attribue un noyau de l’activité à des personnes associées à Moonshot AI, le développeur de Kimi. Cette actualité est distincte des accusations américaines sur la distillation évoquées dans notre précédent article.
Chronologie et ampleur de l’activité rapportée
OpenAI situe le début de l’activité au 1er juillet 2026. Les 24 et 25 juillet, l’entreprise a observé des pics totalisant 16 000 requêtes utilisant un motif associé à l’extraction, provenant de plus de 4 000 utilisateurs. Ce chiffre compte des tentatives, pas des extractions nécessairement réussies.
| Date | Événement rapporté par OpenAI |
| 1er juillet 2026 | Début de l’activité, d’abord à faible volume. |
| 24 et 25 juillet 2026 | Pics de 16 000 requêtes de tentative, associées à plus de 4 000 utilisateurs. |
| 28 juillet 2026 | OpenAI dit avoir interrompu une activité liée de motifs de requêtes, observée dans un groupe de plus de 15 000 utilisateurs. |
| 30 septembre 2026 | OpenAI publie son compte rendu de la campagne. |
Les deux groupes d’utilisateurs correspondent à des constats distincts : plus de 4 000 utilisateurs pour les requêtes des pics, et plus de 15 000 pour l’activité liée relevée ensuite.
La méthode entre conversations décrite par OpenAI
Le raisonnement protégé désigne les étapes internes par lesquelles un modèle traite une tâche, que sa réponse finale ne restitue pas nécessairement. OpenAI décrit une tentative consistant à copier un raisonnement chiffré depuis une conversation, puis à demander à un modèle dans une autre conversation de le déchiffrer et de le transcrire.
Selon OpenAI, cette méthode reposait sur la manipulation des interactions avec les modèles. Les opérateurs n’ont ni brisé le chiffrement, ni compromis de base de données, ni accédé directement aux conversations stockées.
La réponse d’OpenAI et la portée de son attribution
OpenAI dit avoir banni ou restreint des comptes frauduleux, renforcé les contrôles à l’inscription et sur ses infrastructures, élargi la surveillance et ajouté des protections pour le raisonnement caché. L’entreprise indique aussi avoir partagé ses constats avec le Frontier Model Forum et des partenaires gouvernementaux.
OpenAI attribue un noyau de l’activité à des personnes associées à Moonshot AI. L’entreprise précise qu’elle ne sait pas si tous les opérateurs observés relevaient d’un seul acteur.