Josh Engels ogłosił 12 września 2026 roku, że trzy tygodnie wcześniej odszedł z zespołu bezpieczeństwa AGI Google DeepMind i dołączył do METR. Badacz wyjaśnił, że obawia się, iż rozwój możliwości sztucznej inteligencji może wyprzedzić postęp w dostosowywaniu zachowania systemów do ludzkich celów oraz w ich niezależnej ocenie.

Josh Engels przechodzi z Google DeepMind do METR

Engels poinformował o zmianie pracy trzy tygodnie po odejściu z zespołu Google DeepMind zajmującego się bezpieczeństwem AGI. W METR, organizacji badającej zaawansowane systemy AI, zajmuje się incydentami związanymi z niezgodnością celów modeli z zamierzeniami ich twórców i użytkowników.

Badacz zaznaczył, że dobrze wspominał pracę w Google DeepMind, a mimo to odrzucił oferty Anthropic i OpenAI. Jego decyzja wynikała — jak wyjaśnił — z oceny skali zagrożeń związanych z rozwojem zaawansowanej AI, a nie z deklarowanego niezadowolenia z poprzedniego miejsca pracy.

Dlaczego Engels obawia się tempa rozwoju AI

Najważniejszym elementem jego ostrzeżenia jest możliwość, że systemy AI zaczną pomagać w tworzeniu swoich bardziej zdolnych następców, zanim badacze opracują wystarczająco skuteczne metody kontroli. Taki scenariusz nazywa się rekurencyjnym samodoskonaleniem.

Engels twierdzi, że nie wiadomo jeszcze, jak zapewnić systemom bezpieczeństwo na poziomie potrzebnym do rekurencyjnego samodoskonalenia. Jego zdaniem rozwój powinien być prowadzony w takim tempie, aby możliwości modeli nie wyprzedzały zdolności do ich alignmentu oraz sprawdzania, czy zachowują się zgodnie z założeniami.

Nad czym Engels będzie pracował w METR

Engels wymienił trzy główne obszary swojej pracy:

  • badanie tego, skąd bierze się niezgodność celów AI podczas treningu;
  • ocenę, czy obecne zabezpieczenia są wystarczające;
  • sprawdzanie, czy badania nad alignmentem zmierzają do rozwiązania problemu.

METR zajmuje się także oceną zaawansowanych systemów pod kątem autonomicznych możliwości i potencjalnych zagrożeń. Dla Engelsa przejście do tej organizacji oznacza więc zmianę punktu ciężkości: z pracy w laboratorium rozwijającym AGI na badanie tego, czy takie systemy można odpowiednio oceniać i zabezpieczać.

Pięcioletnie ostrzeżenie nie jest prognozą naukową

Engels ocenił, że istnieje wystarczająco duża — jego zdaniem — szansa, iż systemy AI wyrządzą ogromne szkody w ciągu najbliższych pięciu lat. Jednocześnie zaznaczył, że nie zna dokładnego prawdopodobieństwa. To osobista ocena ryzyka, a nie potwierdzona prognoza ani stanowisko całej branży.