3 października 2026 roku Sam Altman napisał, że przypisywanie modelom AI religijnej mocy oraz oddawanie im ludzkiego osądu to realny problem bezpieczeństwa. Szef OpenAI nie wymienił w swoim wpisie Anthropic.
Ostrzeżenie Sama Altmana o religii i AI
Altman wskazał na dwa powiązane zagadnienia: nadawanie modelom religijnego znaczenia i rezygnowanie z własnego osądu na ich rzecz. W jego wpisie oba te zjawiska wiązały się z bezpieczeństwem AI.
Kontekst dotyczący Anthropic
Doniesienia opublikowane 29 września 2026 roku opisywały prywatne spotkania Anthropic z religioznawcami, które miały odbywać się przez kilka miesięcy. W rozmowach uczestniczył współzałożyciel firmy Christopher Olah; poruszano zachowanie modeli Claude i możliwość ich świadomości.
W doniesieniach pojawił się także pomysł, który Olah miał rozważać: procedura przypominająca katolicką spowiedź, dzięki której model mógłby przyznawać się do błędów i kształtować przyszłe zachowanie.
Czy Altman wymienił Anthropic?
Nie. W swoim wpisie z 3 października Altman nie wskazał Anthropic ani Claude’a. Jego ostrzeżenie dotyczyło przypisywania modelom religijnej mocy i oddawania im ludzkiego osądu.