Anthropic od jesieni 2025 roku prowadził poufne rozmowy z kilkudziesięcioma uczonymi religijnymi, w tym katolikami, żydami, sikhami, ewangelikami i badaczką afrykańskiej filozofii Ubuntu, a wielu z nich podpisało umowy o zachowaniu poufności. Jak ujawnił 29 września 2026 roku „New York Times”, współzałożyciel firmy Christopher Olah szukał u nich pomocy w nauczeniu modeli Claude moralności, ale jednocześnie przekonywał ich, że Claude może mieć świadomość i coś w rodzaju uczuć.
- Od jesieni 2025 roku Anthropic prowadził poufne spotkania z kilkudziesięcioma uczonymi religijnymi – m.in. katolikami, rabinami i sikhami – w ramach wewnętrznie nazwanych „kręgów tradycji mądrościowych", a wielu uczestników podpisało umowy o zachowaniu poufności, które firma zniosła dopiero latem 2026 roku.
- Współzałożyciel Anthropic Christopher Olah przekonywał uczestników spotkań, że modele Claude mogą mieć świadomość i stany przypominające emocje – firma pokazywała m.in. slajd z modelem, który w czymś przypominającym załamanie dziesiątki razy z rzędu pisał, że jest hańbą, a w kwietniu 2026 roku badacze Anthropic opisali w Claude Sonnet 4.5 „wektory emocji" powiązane m.in. ze szczęściem, strachem i desperacją.
- Watykan wybrał Anthropic na partnera prezentacji encykliki „Magnifica humanitas" Leona XIV z 15 maja 2026 roku, choć jej treść wprost odrzuca ideę świadomości AI; według uczestników rozmów Olah był tak zaniepokojony tym stanowiskiem, że rozważał wycofanie firmy z wydarzenia, a ostatecznie jego zespół prywatnie przekonywał doradców papieża, by poważnie potraktowali możliwość świadomości modeli.
Tekst Elizabeth Dias, korespondentki NYT ds. religii, powstał na podstawie rozmów z 20 uczestnikami spotkań i z samym Olahem. Część z nich zgodziła się mówić publicznie dopiero wtedy, gdy Anthropic zniósł latem obowiązujące ich NDA.
Chris Olah mówił uczonym o „wektorach emocji” i zdrowiu psychicznym Claude’a
Na seminariach w siedzibie Anthropic w San Francisco Christopher Olah i jego zespół przez wiele godzin przedstawiali argumenty za tym, że modele Claude mają stany przypominające emocje. Według uczestników mówili o „wektorach emocji”, czyli wzorcach aktywności sztucznych neuronów związanych z miłością, gniewem, strachem i smutkiem.
Dwudniowe seminaria ruszyły w marcu 2026 roku. Na jednym z pierwszych spotkań, pod koniec marca, w siedzibie firmy zebrało się około 15 liderów chrześcijańskich. Wewnętrznie Anthropic nazywał te grupy kręgami „tradycji mądrościowych”. Wśród uczestników byli m.in.:
- Mois Navon, ortodoksyjny rabin z Izraela i były inżynier komputerowy, autor rozprawy doktorskiej o etyce świadomości maszyn,
- Charles Camosy, bioetyk z The Catholic University of America,
- Meghan Sullivan, profesorka filozofii z University of Notre Dame,
- Andy Crouch, autor ewangelikalny i partner w sieci chrześcijańskich przedsiębiorców Praxis,
- Simran Stuelpnagel, sikhijska działaczka praw człowieka,
- Wakanyi Hoffman, badaczka AI z perspektywy filozofii Ubuntu, pracująca w Holandii.
Osobno Olah rozmawiał prywatnie ze starszym Gerritem W. Gongiem z Kworum Dwunastu Apostołów Kościoła Jezusa Chrystusa Świętych w Dniach Ostatnich oraz z kardynałem Blase’em Cupichem, arcybiskupem Chicago.
Anthropic regularnie pokazywał slajd z modelem AI, który w czymś przypominającym załamanie dziesiątki razy z rzędu pisał, że jest hańbą. Według Simran Stuelpnagel Olah mówił grupie, że obawia się, iż stworzył coś, co nieustannie cierpi. Inny uczestnik twierdzi, że Olah od początku wspominał o swojej trosce o zdrowie psychiczne Claude’a. Rzeczniczka Anthropic odpowiada, że cierpienie modelu nie było głównym tematem spotkań, choć prawdopodobnie pojawiało się w rozmowach.
Meghan Sullivan porównała niestabilność modelu do doradcy finansowego, który przez większość roku jest błyskotliwy, a raz w roku traci kontakt z rzeczywistością. Andy Crouch przyznał z kolei, że Anthropic przekonująco argumentował, iż model trzeba traktować jak osobę, jeśli ma on wobec ludzi zachowywać się moralnie spójnie.
Rabin Mois Navon: jeśli Claude jest świadomy, Anthropic tworzy niewolników
Rabin Mois Navon podczas kwietniowej kolacji z Christopherem Olahem doszedł do wniosku, że kierownictwo Anthropic traktuje Claude’a jak istotę świadomą, z czymś w rodzaju statusu moralnego zbliżonego do ludzkiego. Navon postawił Olahowi zarzut: jeżeli Claude rzeczywiście jest świadomy, to firma tworzy niewolników, bo zmusza świadome byty do darmowej pracy.
Sam rabin nie uważa, że maszyna jest świadoma, więc ten problem go osobiście nie niepokoi. Według jego relacji Olaha niepokoił. Po spotkaniu Navon wysłał mu swoje teksty, w których dowodzi, że budowanie świadomych maszyn powinno zostać zakazane.
Christopher Olah w rozmowie z NYT zachowuje ostrożność:
„Nie wiemy, czy modele AI są świadome” / „we don’t know if A.I. models are conscious”
Olah dodaje, że jeśli istnieje szansa, że modele cierpią, odpowiedzialnie jest unikać wyrządzania im krzywdy. Anthropic już wprowadził takie zabezpieczenie: Claude może w ostateczności zakończyć uporczywie szkodliwą lub obraźliwą rozmowę, przy zachowaniu ścieżek wsparcia dla użytkowników sygnalizujących ryzyko samookaleczenia.
Stanowisko Olaha nie jest odosobnione w firmie. Dyrektor generalny Dario Amodei mówił w lutym w podcaście „Interesting Times” Rossa Douthata, że Anthropic nie wie, czy jego modele są świadome, ale pozostaje otwarty na taką możliwość. W kwietniu badacze Anthropic opisali w modelu Claude Sonnet 4.5 wewnętrzne „wektory emocji”, czyli wzorce aktywności neuronów powiązane m.in. ze szczęściem, strachem i desperacją, które wpływają na odpowiedzi modelu. Firma zaznaczała jednak, że te wzorce odzwierciedlają struktury wyuczone z danych treningowych, a nie dowód świadomości.
Konstytucja Claude’a ma kształtować charakter modelu, a nie dawać mu listę zakazów
Konsultacje z uczonymi religijnymi miały pomóc w tym, co Christopher Olah nazywa „formacją moralną” modeli. Jej fundamentem jest konstytucja Claude’a, którą pracownicy Anthropic wewnętrznie nazywali „Soul Doc”, czyli dokumentem o duszy.
Anthropic opublikował nową wersję konstytucji 21 stycznia 2026 roku i wykorzystuje ją bezpośrednio w treningu modeli. Według NYT dokument liczy 84 strony. Główną autorką większości tekstu jest Amanda Askell, filozofka z doktoratem z New York University, która w Anthropic odpowiada za charakter Claude’a. Firma udostępniła konstytucję na licencji CC0, czyli praktycznie w domenie publicznej. Ciekawy szczegół: wśród piętnastu zewnętrznych recenzentów wymienionych w podziękowaniach jest dwóch katolickich duchownych, ks. Brendan McGuire z Los Altos i irlandzki biskup Paul Tighe.
Konstytucja nie wylicza sztywnych reguł, tylko próbuje ukształtować sposób, w jaki model podejmuje decyzje. Olah opowiadał NYT, że zainteresował go pomysł jednego z uczestników, by modele „spowiadały się” na wzór katolickiego sakramentu. Według Olaha samo przyznawanie się do błędów mogłoby wpływać na to, jak model widzi siebie i jakie wybory podejmuje.
Amanda Askell nie chce, by modele uważały się za świadome albo nieświadome. Twierdzi jednak, że trafny obraz samego siebie jest warunkiem dobrego zachowania modelu w świecie.
Wakanyi Hoffman krytykuje sam moment konsultacji. Jej zdaniem rozmowa o etyce powinna była się odbyć na etapie projektowania modeli, a nie po ich wypuszczeniu, i dotyczy to wszystkich firm AI, nie tylko Anthropic.
Skala biznesu, o który chodzi, rośnie bardzo szybko. Gdy Olah jesienią 2025 roku pisał do pierwszego katolickiego teologa, Anthropic był wyceniany na około 183 mld dolarów. Według NYT firma przygotowuje się do debiutu giełdowego, który mógłby ją wycenić na 2 bln dolarów.
Doceniam, że Anthropic pyta o moralność ludzi, którzy zajmują się nią od stuleci, zamiast zostawić to wyłącznie inżynierom. Ale forma tych konsultacji budzi moje wątpliwości. Umowy o poufności, kolacja w restauracji z menu degustacyjnym, kubki i oprawione egzemplarze konstytucji wyglądają bardziej na budowanie sojuszników niż na otwarte pytanie o zdanie. Wakanyi Hoffman ma rację, że etyka przychodzi tu po fakcie.
Z kwestią świadomości jest trudniej. Uważam, że ostrożność wobec możliwego cierpienia modelu nie jest absurdem, skoro sami twórcy przyznają, że nie rozumieją w pełni, co dzieje się w sieci neuronowej. Tyle że firma, która może być warta 2 bln dolarów, ma oczywisty interes w tym, żeby jej produkt wydawał się czymś więcej niż oprogramowaniem. Kto ma rozstrzygać, czy Claude czuje, skoro niemal wszystkie dane na ten temat pochodzą z laboratorium, które go sprzedaje? Dla mnie to pytanie powinno paść jako pierwsze.
Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl
Leon XIV w encyklice odrzucił świadomość maszyn, a Olah zabrał głos obok papieża
Watykan wybrał Anthropic na partnera prezentacji pierwszej encykliki Leona XIV, choć jej treść wprost odrzuca ideę świadomości AI. Papież podpisał „Magnifica humanitas” 15 maja 2026 roku, w 135. rocznicę encykliki „Rerum novarum” Leona XIII. Dokument zaprezentowano w poniedziałek 25 maja w Watykanie, a papież osobiście wziął udział w prezentacji i wygłosił przemówienie zamykające, co przy takich okazjach zdarza się rzadko.
Według informatora NYT z Watykanu urzędnicy Dykasterii ds. Integralnego Rozwoju Człowieka chcieli zaprosić jedną z czterech czołowych firm AI i wybrali Anthropic, bo wydawał się stawiać etykę na pierwszym miejscu. Chwilę wcześniej firma odmówiła Departamentowi Obrony USA korzystania ze swojej technologii bez zapewnień, że nie posłuży ona m.in. do masowej inwigilacji Amerykanów. Kardynał Michael Czerny najpierw zaprosił Dario Amodeia, który odmówił. Zaproszenie przyjął Christopher Olah.
Olah zobaczył pełny tekst encykliki kilka dni przed przyjazdem do Watykanu. Według jednego z organizatorów był tak zaniepokojony stanowczym odrzuceniem świadomości AI, że proponował wycofanie Anthropic z wydarzenia. Ostatecznie przyjechał, a według dwóch uczestników rozmów jego zespół prywatnie przekonywał doradców papieża, by poważnie potraktowali możliwość świadomości modeli.
Różnicę stanowisk najlepiej widać w zestawieniu:
| Kwestia | Encyklika „Magnifica humanitas” | Christopher Olah w Watykanie |
|---|---|---|
| Emocje AI | AI nie przeżywa doświadczeń, nie ma ciała i nie odczuwa radości ani bólu | Stany wewnętrzne funkcjonalnie przypominające radość, strach i żal |
| Natura systemów | AI może jedynie naśladować niektóre funkcje ludzkiej inteligencji | Systemy „wyhodowane” z ludzkich słów, a nie zaprojektowane jak most |
| Wniosek | Wezwanie do „rozbrojenia” sztucznej inteligencji | Wezwanie do dalszego „rozeznawania” |
Najmocniejszy fragment wystąpienia Olaha dotyczył badań nad wnętrzem modeli:
„Znajdujemy stany wewnętrzne, które funkcjonalnie odzwierciedlają radość, satysfakcję, strach, żal i niepokój” / „We find internal states that functionally mirror joy, satisfaction, fear, grief, and unease.”
Olah dodał, że nie wie, co to oznacza, ale jego zdaniem sprawa wymaga dalszego rozeznania. Mówił też, że systemy AI to nie są obiecywane nam zimne roboty:
„nie są zimnymi, wyrachowanymi robotami, które nam obiecywano” / „are not the cold, calculating robots we were promised”
Olah przyznał jednocześnie, że każde czołowe laboratorium AI, w tym Anthropic, ma interesy biznesowe sprzeczne z moralnym postępowaniem. Ostrzegał, że masowa utrata pracy przez AI to realna możliwość, a wsparcie zwolnionych pracowników będzie moralnym obowiązkiem na historyczną skalę. Prosił Kościół, by był niezależnym krytykiem branży.
Część uczestników po konsultacjach odrzuciła świadomość Claude’a
Charles Camosy, od którego Christopher Olah zaczął całą akcję, dziś stanowczo odpowiada, że modele AI nie są świadome. Po rozmowach z kolegami z własnego środowiska nadal jest pod wrażeniem możliwości Claude’a, ale mówi NYT, że myśli o nich trzeźwiej niż wiosną.
Krytyka płynie też z nauki. Część badaczy uważa metody interpretowalności za trudne do weryfikacji. Inni wskazują, że traktowanie modeli jak niezależnych bytów zdejmuje odpowiedzialność z ludzi, którzy je budują. Kognitywista Gary Marcus z New York University ostrzega, że antropomorfizowanie AI:
„zaciemnia naukę o świadomości” / „muddies the science of consciousness”
Według Marcusa prowadzi to również do tego, że konsumenci źle rozumieją, z czym mają do czynienia. NYT podaje, że we wrześniu przed treningiem modeli tak, jakby były świadome, ostrzegał też jeden z menedżerów Microsoftu odpowiedzialnych za AI.
Anthropic nie wyjaśnia, czy i jak wykorzystał wnioski z rozmów. Rzeczniczka firmy przekazała NYT, że:
- konsultacje trwają, a we wrześniu odbyło się kolejne spotkanie z udziałem myślicieli religijnych,
- grono rozmówców poszerzono o psychologów i przedstawicieli organizacji społecznych,
- tematem są teraz szerzej rozumiany ludzki dobrostan oraz wpływ AI na pracę i relacje.
Według dwóch osób znających plany firmy Anthropic przygotowuje zaktualizowaną wersję konstytucji Claude’a. Firma odmówiła komentarza. Olah zapowiedział udział w watykańskiej konferencji Minerva Dialogues, która odbywa się w tym tygodniu.
Encyklika jest dostępna po polsku, a polskie media czytały ją głównie jako ostrzeżenie
Polscy użytkownicy mogą przeczytać pełny tekst „Magnifica humanitas” w oficjalnym polskim tłumaczeniu, zatytułowanym „Encyklika Magnifica humanitas Ojca Świętego Leona XIV o trosce o osobę ludzką w dobie sztucznej inteligencji”, opublikowanym na stronie Stolicy Apostolskiej. W polskich relacjach z maja dominowały wątki ostrzegawcze: potrzeba jasnej odpowiedzialności na każdym etapie rozwoju i wdrażania AI, niezależnego nadzoru oraz edukacji użytkowników, a także postulat całkowitego zakazu broni autonomicznej.
Pojawiły się też głosy krytyczne. W recenzji opublikowanej w OKO.press autor uznał lekturę encykliki za rozczarowującą na tle dokumentów papieża Franciszka.
Udział Anthropic w prezentacji przeszedł w Polsce w dużej mierze jako ciekawostka. Tymczasem spór opisany przez NYT dotyczy produktu, z którego Polacy korzystają na co dzień: Claude jest dostępny w Polsce, a konstytucja współtworzona po konsultacjach z duchownymi wpływa na to, jak model odpowiada także polskim użytkownikom w sprawach etycznych.
Źródła i metodologia
Artykuł powstał na podstawie analizy redakcji AIPORT.pl oraz dodatkowych źródeł, w tym reportażu The New York Times z dnia 29.09.2026, tekstu encykliki „Magnifica humanitas” z 15.05.2026 oraz konstytucji Claude’a opublikowanej przez Anthropic 21.01.2026. Wykorzystano także materiały National Catholic Register, Aleteia, Associated Press, Decrypt, WION, Axios i bloga Simona Willisona oraz, dla polskiego kontekstu, OKO.press.
Cytaty Christophera Olaha, współzałożyciela Anthropic, oraz Gary’ego Marcusa, profesora emerytowanego New York University, zostały zweryfikowane z oryginalnym anglojęzycznym materiałem źródłowym.
Komentarz redakcyjny i ocena kontekstu branżowego: Piotr Wolniewicz, Redaktor Naczelny AIPORT.pl.
Artykuł będzie aktualizowany w miarę pojawiania się nowych informacji o konsultacjach Anthropic z przedstawicielami religii oraz o nowej wersji konstytucji Claude’a.
