Satya Nadella schlug am 10. Oktober 2026 vor, dass eine autorisierte Person ein KI-Modell mitten in einer Aufgabe pausieren oder abschalten können soll. Zugriffs- und Aktionskontrollen müssten dafür außerhalb des Modells liegen, schreibt der Microsoft-Chef in seinem Beitrag. Der Vorschlag knüpft an Nadellas Forderung an, fortgeschrittene KI unter menschlicher Kontrolle zu halten, die wir zuvor eingeordnet haben.

Was das KI-Not-Aus leisten soll

Nadella beschreibt keine Taste, sondern ein Kontrollprinzip: Ein Mensch mit entsprechender Berechtigung soll ein Modell während seiner Arbeit anhalten können. Die Kontrolle über Zugriffe und erlaubte Aktionen soll außerhalb des Modells liegen, damit das Modell sie nicht selbst verändern oder umgehen kann.

Dazu gehört auch eine Trennung zwischen dem Modell und der Orchestrierungsschicht – jener Software, die seine Arbeit steuert und ihm Werkzeuge bereitstellt. So soll die Fähigkeit des Modells, Aufgaben zu bearbeiten, nicht zugleich die Autorität einschließen, über die eigenen Grenzen zu bestimmen.

Nadella ordnet den Vorschlag in sieben Leitprinzipien ein: Vielfalt bei Modellen, Beobachtbarkeit, Überprüfbarkeit, unabhängige Kontrollen, unabhängige Auditierbarkeit, Eindämmung und die Offenlegung von Vorfällen. Bedeutsame Aktionen sollen zudem manipulationssichere, menschenlesbare Spuren hinterlassen. So ließe sich nachvollziehen, was geschehen ist, ohne allein auf die eigene Darstellung des Modells angewiesen zu sein. Er fordert außerdem fortlaufende Tests des Gesamtsystems – auch auf Fehler, Angriffe und Grenzfälle, nicht nur auf erfolgreiche Aufgaben.

Warum Transparenz allein nicht genügt

https://x.com/satyanadella/article/2108931348857827686

Nadella hält Transparenz über die Chain of Thought (CoT), also die ausgegebenen Zwischenschritte einer Modellbegründung, für unverzichtbar. Als alleinige Sicherheitsmaßnahme reicht sie ihm jedoch nicht: Modellausgaben bilden ihre Abläufe nicht durchgehend zuverlässig und transparent ab. Ein Einblick in solche Ausgaben ersetzt deshalb in seinem Ansatz weder externe Kontrollen noch Tests und Eindämmung.

Der Grund für diese Vorsicht ist nicht die Annahme, ein Modell sei böswillig. Nadella argumentiert, dass ein leistungsfähiger Akteur mit Zugang zu wichtigen Systemen Fehler machen oder kompromittiert werden kann. Für ihn rechtfertigt schon dieses Risiko eine Architektur, die Grenzen von außen durchsetzt und menschliches Eingreifen ermöglicht.

Mehr Eindämmung für leistungsfähigere Modelle

Nadella fordert, dass fortgeschrittenere Modelle auch fortschrittlichere Eindämmungstechnologien erhalten und solche Technologien standardisiert werden. Das ist Teil seines Vorschlags für künftige KI-Sicherheit: Kontrolle soll nicht allein davon abhängen, was ein Modell über seine eigenen Abläufe ausgibt, sondern auch von unabhängig gesetzten Grenzen und überprüfbaren Systemen.