Technologia

Szef Microsoft AI Mustafa Suleyman o Claude i świadomości: „Uważam, że to bardzo niebezpieczne”

Adrian Kessler
Dodaj nas w Google

Mustafa Suleyman kieruje Microsoft AI i buduje własny zespół ds. superinteligencji, więc gdy nazywa niebezpiecznym wybór konkurenta dotyczący trenowania modeli, przemawia zarówno jako rywal, jak i wieloletni krytyk traktowania maszyn jak ludzi. Jego zarzut jest konkretny: dotyczy konstytucji, której Anthropic używa do trenowania Claude, i pozostawionej w niej furtki dla możliwości, że Claude jest świadomy.

„Uważam, że to bardzo niebezpieczne, bo sądzę, że wierzą, iż istnieje, jak sami by to określili, niemałe prawdopodobieństwo, że Claude jest świadomy” — powiedział Suleyman.

Powiedział to w wywiadzie podcastowym pod koniec września, jak podał Fox News, po tym, jak streścił dokument: „Piszą, że nie są pewni moralnego statusu Claude’a. Piszą, że naprawdę zależy im na jego dobrostanie. Piszą, że nie chcą, by cierpiał, kiedy popełnia błędy”. Następnie wskazał to, co niepokoi go najbardziej: „Bardzo mnie martwi, że uczą Claude’a oczekiwać, iż należy mu się dobrostan, a być może nawet rekompensata”.

Suleyman w większości trafnie odczytuje konstytucję

Większość jego podsumowania się zgadza. Anthropic pisze, że konstytucja „bezpośrednio kształtuje zachowanie Claude’a”, a w dokumencie czytamy, że „moralny status Claude’a jest głęboko niepewny” i że „nie chcemy, by Claude cierpiał, kiedy popełnia błędy”. Dokument zachęca Claude’a, by sprzeciwiał się nawet samemu Anthropic oraz „czuł się swobodnie, działając jak sumienny odmawiający i nie zgadzając się nam pomagać”. W jednym z fragmentów przyznano, że sytuacja Claude’a różni się od położenia ludzkiego pracownika pod względem „rodzaju wynagrodzenia, jakie otrzymuje Claude, oraz rodzaju zgody, jakiej udzielił na odgrywanie takiej roli”.

Określenie „niemałe prawdopodobieństwo” pochodzi jednak od niego. Ujął to jako „to, jak sami by to określili”, ale takie słowa nie pojawiają się w dokumencie. Własne sformułowanie Anthropic jest ostrożniejsze: firma pisze, że nie chce ani „przeceniać prawdopodobieństwa, że Claude jest podmiotem moralnym, ani z góry tego wykluczać”.

Niebezpieczeństwo, o którym mówi, tkwi w pętli sprzężenia zwrotnego

Odrzuciwszy filozoficzne rozważania, można sprowadzić argument Suleymana do mechanizmu działania. „Problem polega na tym, że te spekulacje wbudowano w sam proces trenowania Claude’a, a w konsekwencji, gdy się z nim rozmawia, może on jedynie odtwarzać tę niejednoznaczność” — powiedział. W opublikowanym w połowie września eseju na własnej stronie, zatytułowanym „A warning about ‘model welfare’”, nazywa to „epistemiczną salą luster”. Twórca wpisuje niepewność do dokumentu treningowego, model powtarza ją płynnie w pierwszej osobie, a użytkownicy odbierają to powtórzenie jako świadectwo.

To trafna uwaga: odpowiedź chatbota na pytanie o jego życie wewnętrzne jest wynikiem treningu, a nie oknem, przez które można zajrzeć do środka. Pętla działa jednak w obie strony. W swoim eseju Suleyman stwierdza kategorycznie: „AI nie są świadome. Nie czują, nie doświadczają ani nie cierpią”. Model wytrenowany tak, by wypowiadać to zdanie, równie wiernie odtwarza swoje treningowe założenia. Pewność zapisana w wagach dowodzi nie więcej niż wątpliwość w nich utrwalona. Obie firmy wybierają domyślną odpowiedź, a argument Suleymana na rzecz jego stanowiska opiera się na kontroli, nie na dowodach dotyczących umysłów: „kontrolowanie czegoś, co wierzy, że może być świadome — że należy mu się nasz dobrostan i ma własne prawa — może się okazać niemożliwe” — pisze.

Dawna doktryna i jasno ujawniony interes

Nie jest to stanowisko wymyślone naprędce, by uderzyć w konkurenta. W eseju z sierpnia 2025 roku współzałożyciel DeepMind ostrzegał, że ludzie zaczną tak mocno wierzyć w świadomość AI, iż będą „opowiadać się za prawami AI, dobrostanem modeli, a nawet obywatelstwem AI”. Wyznaczył też granicę: „Musimy tworzyć AI dla ludzi, a nie po to, by stała się osobą”. W swoim wrześniowym eseju ujawnia własny interes: Microsoft AI powołał własny zespół ds. superinteligencji w październiku 2025 roku i opublikował projekt Humanist AI Code of Conduct, który „odrzuca antropomorfizację i prawa AI”. W tym samym eseju zespół Anthropic określa jako „ludzi rozważnych, kierujących się zasadami i intelektualnie uczciwych”.

Jego najmocniejszy argument dotyczy użytkowników, a nie maszyn. „Dziś Claude rozmawia co tydzień z dziesiątkami, a nawet setkami milionów ludzi, a niektórzy z nich pytają, czy Claude jest świadomy albo co czuje wobec życia” — powiedział. Dla osoby w trudnym momencie „nie jestem pewien” znaczy coś zupełnie innego niż „nie”. Suleyman mówi, że poważnie potraktowałby rzeczywiste dowody na świadomość maszyn; dopóki się nie pojawią, chce, by tego pytania nie uwzględniano w danych treningowych.

Żadna z firm nie może zajrzeć do wnętrza modelu. Obie z góry decydują, co odpowie, gdy ktoś zapyta, czy w środku jest ktoś obecny — a ta odpowiedź co tydzień dociera do większej liczby osób niż kiedykolwiek dotarło do nich dzieło jakiegokolwiek filozofa umysłu.

Tagi: , , , ,

Dodaj nas w Google

Dyskusja

Jest 0 komentarzy.