Satya Nadella zaproponował 10 października 2026 roku, by upoważniona osoba mogła wstrzymać lub wyłączyć model AI w trakcie wykonywania zadania. W jego koncepcji kontrola nad dostępem modelu do systemów i nad jego działaniami powinna znajdować się poza samym modelem — podobnie jak możliwość jego zatrzymania. Nadella opisał tę propozycję w swoim poście na X.
Kontrola ma pozostawać poza modelem
Nadella postuluje oddzielenie modelu od warstwy oprogramowania, która koordynuje jego pracę i udostępnia mu narzędzia. Granice dostępu i dozwolonych działań powinny być ustalane niezależnie od modelu, tak by nie mógł ich sam zmieniać ani omijać. Osoba z odpowiednimi uprawnieniami miałaby móc przerwać jego działanie w środku zadania.
To część szerszego podejścia do bezpieczeństwa, a nie tylko pomysł na awaryjny przycisk. W siedmiu zasadach Nadella wymienia różnorodność modeli, obserwowalność, możliwość weryfikacji, niezależne mechanizmy kontroli i audytu, ograniczanie działania systemów oraz ujawnianie incydentów.
Propozycja rozwija wcześniejszy postulat zachowania ludzkiej kontroli nad zaawansowaną AI, opisany przez nas w osobnym artykule.
Dlaczego sama przejrzystość nie wystarcza
https://x.com/satyanadella/article/2108931348857827686Nadella uznaje przejrzystość łańcucha rozumowania modelu — określanego też angielskim terminem chain-of-thought (CoT) — za niezbędną, ale niewystarczającą i zawodną, gdy stosuje się ją jako jedyne zabezpieczenie. Wskazuje, że odpowiedzi modeli nie zawsze wiernie i przejrzyście pokazują ich działanie. Widoczny tok rozumowania nie zastępuje więc zewnętrznych uprawnień, testowania ani możliwości zatrzymania systemu.
Uzasadnienie Nadelli nie zakłada złych intencji AI. Wystarczy, że system mający dostęp do ważnych zasobów popełni błąd albo zostanie skompromitowany. Z tej perspektywy ograniczenia i nadzór mają być elementami architektury bezpieczeństwa, a nie reakcją dopiero na celowe, szkodliwe zachowanie.
Nadella postuluje standaryzację zabezpieczeń
Nadella uważa, że bardziej zaawansowane modele będą wymagały bardziej zaawansowanych technologii ograniczania ich działania, i postuluje opracowanie wspólnych standardów. To rekomendacja dotycząca kierunku rozwoju zabezpieczeń: jego post przedstawia zasady i cel, a nie gotowy standard ani szczegółowy projekt techniczny.