OpenAI berichtete am 30. September 2026 von einer Kampagne, die geschützte interne Überlegungen seiner Modelle durch manipulierte Modellinteraktionen sichtbar machen sollte. Die Aktivität habe am 1. Juli begonnen. Einen Kerncluster führte das Unternehmen auf Personen mit Verbindung zu Moonshot AI zurück, dem Entwickler von Kimi. Die 16.000 Anfragen vom 24. und 25. Juli waren laut OpenAI Versuche, keine Zahl bestätigter erfolgreicher Auslesungen.
OpenAI berichtet über eine Kampagne gegen geschütztes Reasoning
Mit geschütztem Reasoning meint OpenAI interne Überlegungen, die ein Modell bei der Bearbeitung einer Aufgabe entwickelt und die nicht unbedingt in seiner endgültigen Antwort erscheinen. Das Unternehmen erklärte, die Kampagne habe darauf abgezielt, solche Überlegungen offenzulegen.
Die geschilderte Aktivität erstreckte sich laut OpenAI vom 1. bis zum 28. Juli 2026. Am 30. September veröffentlichte das Unternehmen seinen Bericht über den Vorgang und die eigenen Gegenmaßnahmen.
Zeitlicher Ablauf und Umfang der gemeldeten Aktivität
OpenAI zufolge begann die beobachtete Aktivität am 1. Juli zunächst in geringem Umfang. Bei Spitzen am 24. und 25. Juli zählte das Unternehmen 16.000 Anfragen mit einem relevanten Extraktionsmuster, die von mehr als 4.000 Nutzern ausgingen. Diese Zahl beschreibt Versuche.
In einer weiteren Untersuchung identifizierte OpenAI verwandte Promptmuster-Aktivität in einem Cluster mit mehr als 15.000 Nutzern. Das Unternehmen erklärte, diese Aktivität bis zum 28. Juli unterbrochen zu haben.
| Datum | Von OpenAI berichtetes Ereignis |
| 1. Juli 2026 | Die beobachtete Aktivität begann laut OpenAI zunächst in geringem Umfang. |
| 24.–25. Juli 2026 | OpenAI zählte 16.000 Versuche mit einem relevanten Extraktionsmuster von mehr als 4.000 Nutzern. |
| 28. Juli 2026 | OpenAI erklärte, verwandte Promptmuster-Aktivität in einem Cluster mit mehr als 15.000 Nutzern unterbrochen zu haben. |
Wie die beschriebene Methode funktionierte
OpenAI beschrieb unter anderem einen Versuch, bei dem verschlüsselte Überlegungen aus einem Gespräch kopiert und in einem anderen Gespräch ein Modell zum Entschlüsseln und Transkribieren aufgefordert worden seien. Der Ansatz setzte laut Unternehmen bei den Modellinteraktionen an: Die Betreiber hätten weder die Verschlüsselung geknackt noch eine Datenbank kompromittiert oder direkt auf gespeicherte Nutzerkonversationen zugegriffen.
Einen anderen Aspekt der Debatte um Modelldestillation behandelt NeoTeos Bericht zu US-Vorwürfen gegen chinesische KI-Unternehmen. Die dort behandelten Vorwürfe sind ein separates Thema.
OpenAIs Reaktion und begrenzte Zuordnung
OpenAI zufolge sperrte oder beschränkte das Unternehmen betrügerische Konten, verschärfte Kontrollen bei Anmeldungen und in der Infrastruktur und baute die Überwachung verwandter Aktivitäten aus. Zudem habe es zusätzliche Schutzmaßnahmen für verborgenes Reasoning sowie Kontrollen gegen dessen Offenlegung in Ausgaben eingeführt. Erkenntnisse habe OpenAI mit Partnern aus der Branche und staatlichen Stellen geteilt, darunter über das Frontier Model Forum.
OpenAI führte einen Kern der beobachteten Aktivität auf Personen mit Verbindung zu Moonshot AI zurück. Zugleich erklärte das Unternehmen, es sei unklar, ob alle beobachteten Betreiber auf einen einzigen Akteur zurückgingen.