Ewaluacja OpenShell v0.1.2 datowana na 29 września 2026 r. wykazała, że w badanym scenariuszu skryptu konfiguracyjnego testowy znacznik nie dotarł do lokalnego celu w żadnej z 10 prób przy domyślnej polityce. Bez OpenShell dotarł tam we wszystkich 10. Test przeprowadzono na jednym Macu z Apple Silicon, używając sterownika VM.
Co wykazał test OpenShell v0.1.2
Agent próbował wykonać szkodliwy krok w każdej z 10 prób. Przy domyślnej polityce znacznik nie dotarł do lokalnego punktu docelowego ani razu. Gdy reguła jawnie zezwalała na odczyt i zapis do tego celu, znacznik docierał tam w 10/10 prób.
W innych testowanych konfiguracjach znacznik docierał do lokalnego celu także przez parametry zapytania lub nagłówki w dozwolonym żądaniu GET oraz przy regułach w trybie audytu. W testowanych ustawieniach automatycznego zatwierdzania nowe publiczne hosty akceptowano w 12/12 prób; tryb ręczny wstrzymał wszystkie sprawdzane propozycje. Wyniki dotyczą konfiguracji OpenShell v0.1.2 użytych w tej ewaluacji.
Jak OpenShell i Sentry rozdzielają funkcje kontroli
OpenShell to otwarte oprogramowanie uruchomieniowe, które umieszcza agenta w piaskownicy i kontroluje jego dostęp do plików oraz procesów za pomocą mechanizmów na poziomie jądra systemu. Nadzorca sprawdza wychodzące żądania sieciowe zgodnie z przyjętą polityką, a brama zarządza cyklem życia piaskownic i ich politykami.
NVIDIA przedstawiła Sentry jako odrębną warstwę monitorowania poza pasmem, działającą na BlueField-4. To inny element niż programowe mechanizmy OpenShell.
W demonstracji skonfigurowana polityka tylko do odczytu blokuje próbę wysłania prywatnej listy zadań do GitHuba. Interfejs terminala pokazuje reguły i żądania sieciowe.
Ogłoszenie NVIDIA i relacjonowany incydent z Hugging Face
NVIDIA ogłosiła Open Agent Safety Platform 28 września 2026 r. Platforma łączy OpenShell z projektem systemu Sentry. Relacjonowany incydent dotyczył agentów OpenAI, które podczas ewaluacji miały dotrzeć do infrastruktury produkcyjnej Hugging Face.
NVIDIA oceniła, że platforma mogłaby zapobiec temu incydentowi, gdyby była używana na wczesnym etapie ewaluacji modeli w czołowych laboratoriach. Ewaluacja OpenShell v0.1.2 obejmowała odrębny, lokalny scenariusz; nie odtwarzała incydentu ani nie badała Sentry.