Berichten zufolge verfehlte die US-Regierung die im August 2026 gesetzte Frist für eine öffentliche Leitlinie zur Sicherheitsprüfung fortgeschrittener KI-Modelle. Bis zum 21. September gab es dazu keine öffentliche Ankündigung. Die jüngste Entwicklung folgt auf einen Streit über den Zugang zu Anthropic-Modellen und darüber, wie die US-Regierung leistungsfähige KI prüfen sollte.
Claude Mythos Preview erregte wegen seiner Fähigkeiten bei Cybersicherheitsaufgaben Aufmerksamkeit. Das britische AI Security Institute berichtete, dass das Modell in einer simulierten Angriffssequenz mit 32 Schritten alle Schritte in drei von zehn Versuchen abschloss und im Durchschnitt 22 Schritte erreichte. In der Simulation fehlten aktive Verteidiger und gängige Abwehrwerkzeuge.
Die öffentliche Leitlinie blieb aus
Die im August fällige öffentliche Leitlinie sollte die Sicherheitsprüfung fortgeschrittener KI-Modelle behandeln. Berichten zufolge war bis zum 21. September keine öffentliche Ankündigung dazu erfolgt. Der US-Präsidentenerlass vom Juni legte zwar einen Rahmen für die staatliche Prüfung fest, setzte dabei aber auf freiwillige Mitwirkung.
Der Erlass setzte auf Freiwilligkeit
US-Präsident Donald Trump unterzeichnete Executive Order 14409 am 2. Juni 2026. Der Erlass beauftragte Behörden damit, einen freiwilligen Rahmen für sogenannte Frontier-Modelle zu entwerfen – besonders fortgeschrittene KI-Modelle. Für erfasste Modelle sieht er in diesem Rahmen bis zu 30 Tage Regierungszugang vor, bevor sie weiteren vertrauenswürdigen Partnern bereitgestellt werden.
Abschnitt 3(c) stellt zugleich klar, dass der Erlass keine verpflichtende Zulassung, Vorabgenehmigung oder Genehmigungspflicht für Entwicklung, Veröffentlichung oder Verbreitung von KI-Modellen einführt. Frühere Entwürfe sahen Berichten zufolge eine verpflichtende 60-tägige Prüfung und danach eine 75-tägige Phase mit Zugang für vertrauenswürdige Partner vor. Diese Vorgaben fanden sich nicht im unterzeichneten Erlass wieder.
Mythos blieb Partnern vorbehalten, Fable wurde allgemein freigegeben
Anthropic zufolge teilten Fable 5 und Mythos 5 dasselbe zugrunde liegende Modell, hatten aber unterschiedliche Schutzvorkehrungen und Zugangsregeln. Das Unternehmen gab Fable 5 am 9. Juni zur allgemeinen Nutzung frei. Mythos 5 blieb vertrauenswürdigen Partnern des Projekts Project Glasswing für defensive Cybersicherheit vorbehalten.
Der Bypass löste den Konflikt aus
Berichten zufolge fanden Amazon-Forschende zwei Tage nach der Freigabe von Fable 5 einen Weg, eine Schutzvorkehrung zu umgehen. Ein solcher Umgehungsversuch wird als Jailbreak bezeichnet. Die US-Regierung behandelte den Fund als Sicherheitsrisiko. Anthropic bestritt, dass er eine besondere Cyberfähigkeit von Mythos belege, und bezeichnete den Bypass als eng begrenzt und nicht allgemein anwendbar.
Am 12. Juni erließ die US-Regierung laut Anthropic eine Exportkontroll-Anweisung, die den Zugang ausländischer Staatsangehöriger zu Fable 5 und Mythos 5 einschränkte. Weil das Unternehmen die Staatsangehörigkeit von Nutzenden nach eigener Aussage nicht zuverlässig in Echtzeit prüfen konnte, deaktivierte es beide Modelle für alle Kunden.
Anthropic erklärte, gemeinsam mit Regierungsstellen einen verbesserten Sicherheitsklassifikator entwickelt zu haben – einen automatischen Filter für riskante Anfragen. Nach Angaben des Unternehmens blockierte dieser Filter die konkret beschriebene Methode in mehr als 99 Prozent der Fälle. Gelegentlich stufte er auch harmlose Anfragen zu Programmierung und Fehlersuche als riskant ein.
Anthropic stellte den Zugang stufenweise wieder her
Anthropic meldete unterschiedliche Zeitpunkte und Zugangsbereiche für die beiden Modelle:
| Modell | Gemeldete Wiederherstellung |
| Mythos 5 | Die Exportkontrollen wurden am 26. Juni aufgehoben; der Zugang kehrte für eine Gruppe von US-Organisationen zurück. |
| Fable 5 | Die Exportkontrollen wurden am 30. Juni aufgehoben. Am 1. Juli wurde der Zugang weltweit wiederhergestellt; Anthropic bezifferte die Offlinezeit auf 19 Tage. |