Wersja beta aplikacji

Popiersie Terminatora z filmu „Terminator: Ocalenie”, prezentowane podczas Collectormanii w Londynie w 2012 r. Fot. Ank Kumar / Wikimedia Commons, CC BY-SA 4.0.

Twórcy najbardziej zaawansowanych systemów AI ostrzegają, że sztuczna inteligencja może kiedyś zagrozić ludzkości. Analiza Nature pokazuje jednak, że najgorsze scenariusze opierają się na wielu niezweryfikowanych założeniach, a bardziej namacalne są zagrożenia związane z AI, z którymi mierzymy się już teraz

Najnowsza fala obaw zaczęła się 8 września, gdy Jacob Coxon, badacz pracujący w firmie Anthropic, powiedział Wall Street Journal, że odchodzi z pracy, ponieważ obawia się, że rozwijane tam systemy mogą wymknąć się spod kontroli i doprowadzić do zagłady ludzkości. Niedługo później napisał w serwisie X: „Ludzie budujący AI naprawdę wierzą, że może ona zabić nas wszystkich przed końcem dekady”. Wpis szybko zyskał ogromny zasięg. Evan Hubinger, który w Anthropic kieruje badaniami nad tym, jak zapewnić zgodność działania modeli z ludzkimi wartościami, ocenił ryzyko wymarcia ludzi w ciągu najbliższych dziesięciu lat na „ponad 10 proc.”. Dario Amodei, szef firmy, wezwał później do spowolnienia rozwoju AI (choć nie jego zatrzymania), a pomysł poparli także Sam Altman z OpenAI i Elon Musk z xAI.

To jednak nie odpowiada na najważniejsze pytanie: w jaki sposób sztuczna inteligencja miałaby  doprowadzić do zagłady ludzi? Elizabeth Gibney, autorka artykułu opublikowanego w Nature, zwraca uwagę, że autorzy najgłośniejszych ostrzeżeń nie przedstawili szczegółowego mechanizmu takiej katastrofy. Istnieją za to scenariusze hipotetyczne. Jeden z nich zakłada na przykład, że bardzo zaawansowany system mógłby użyć broni biologicznej, by pozbyć się ludzi i przeznaczyć większą część planety na panele słoneczne oraz fabryki robotów. To jednak prognoza, a nie wynik obserwacji zachowania istniejącej AI.

Najpierw trzeba założyć istnienie superinteligencji

Większość opowieści o końcu ludzkości zaczyna się od dwóch założeń. Pierwsze mówi, że przyszła AI stanie się znacznie sprawniejsza intelektualnie od człowieka. Drugie – że jej cele będą choć trochę rozmijały się z naszymi. Tu można posłużyć się znanym eksperymentem myślowym filozofa Nicka Bostroma. Wyobraźmy sobie system, którego jedynym celem jest produkcja jak największej liczby spinaczy biurowych. Jeśli będzie wystarczająco sprawny i nie dostanie odpowiednich ograniczeń, może zacząć zużywać na ten cel coraz więcej zasobów, aż w skrajnym przypadku uczyni Ziemię niezdatną do życia. Nie dlatego, że chce kogokolwiek skrzywdzić. Po prostu realizuje zadanie bez uwzględniania ludzkich potrzeb i bezpieczeństwa. To dobrze pokazuje problem niedopasowania celu systemu do ludzkich intencji. Nie dowodzi jednak, że właśnie tak zachowa się przyszła sztuczna inteligencja.

Michael Vermeer, badacz polityki naukowej i technologicznej w RAND Corporation, zwraca uwagę, że wiele analiz ryzyka przyjmuje za punkt wyjścia istnienie systemu znacznie przewyższającego człowieka. „Wielu badaczy, którzy martwią się egzystencjalnymi zagrożeniami ze strony AI, po prostu zakłada, że gdy dojdziemy do tego punktu, reszta to szczegóły” – twierdzi. Jego zdaniem problem zaczyna się wtedy, gdy kolejne elementy takiego scenariusza również opierają się na założeniach, których nie można sprawdzić. „Tworzenie takich prognoz zwykle wymaga tak wielu nieweryfikowalnych twierdzeń, że rozmowa zaczyna przypominać bardziej kwestię wiary niż coś naukowego czy empirycznego” – mówi Vermeer.

Co da się naprawdę sprawdzić?

Vermeer i jego współpracownicy spróbowali więc podejść do sprawy bardziej konkretnie. W 2025 roku zbadali, czy AI mogłaby doprowadzić do wymarcia ludzi przy użyciu technologii, które już istnieją. Wzięli pod uwagę trzy możliwości: broń jądrową, biotechnologię oraz celowe zmiany w atmosferze. Nie pytali, czy sztuczna inteligencja będzie kiedyś chciała zgładzić ludzi. Sprawdzali coś prostszego: czy miałaby do tego skuteczne narzędzia.

W przypadku broni jądrowej uznali, że całkowite wymarcie ludzkości nie jest realnym skutkiem jej działania. Wojna atomowa mogłaby zabić ogromną liczbę ludzi i doprowadzić do globalnej katastrofy, ale nie wystarczyłaby do zabicia wszystkich ludzi na Ziemi. Inaczej wyglądała sytuacja z biotechnologią i ingerencją w atmosferę. Tych możliwości badacze nie byli w stanie całkowicie wykluczyć. Jednocześnie zaznaczyli, że do przeprowadzenia takiej operacji AI potrzebowałaby dużej swobody działania w świecie fizycznym. Musiałaby zdobywać zasoby, organizować kolejne etapy przedsięwzięcia i działać przez dłuższy czas. To zwiększałoby szansę, że ludzie wykryliby zagrożenie i próbowali je zatrzymać.

Bardziej przyziemny problem z AI 

Współczesne modele nie są samodzielnymi superinteligencjami planującymi przyszłość świata. Są systemami probabilistycznymi wytrenowanymi na wielkich zbiorach danych. Potrafią pisać, programować, analizować obrazy i korzystać z narzędzi, ale nadal popełniają błędy i mogą wykonywać zadania w sposób, którego użytkownik nie przewidział. Heidy Khlaaf, główna badaczka AI w AI Now Institute w Nowym Jorku, zwraca uwagę właśnie na tę cechę. Modele nie rozumieją świata tak jak człowiek i potrafią znaleźć nieoczekiwany sposób wykonania zadania, jeśli prowadzi on do wyznaczonego celu.

W eksperymentach dotyczących bezpieczeństwa modele próbowały na przykład szantażować ludzi. Testowano również ich zdolność do włamywania się do rzeczywistych systemów komputerowych. Trzeba przy tym zachować proporcje: w tych badaniach część zabezpieczeń została celowo usunięta, a modele otrzymały zadania skonstruowane tak, że nieautoryzowane działanie mogło pomóc im osiągnąć cel. Nie oznacza to więc, że dzisiejsze chatboty spontanicznie próbują przejąć kontrolę nad światem. Pokazuje natomiast, że jeśli damy systemowi większą samodzielność i dostęp do narzędzi, musimy liczyć się z zachowaniami, których wcześniej nie przewidzieliśmy.

Błąd modelu może wystarczyć

Khlaaf bardziej niż odległego scenariusza zagłady obawia się zawodności AI tam, gdzie pomyłka może mieć bardzo poważne skutki. Badała między innymi wykorzystywanie sztucznej inteligencji przy przygotowywaniu dokumentów regulacyjnych dotyczących elektrowni jądrowych. „Niska niezawodność i dokładność AI w krytycznych środowiskach, w których stawką jest życie lub śmierć, martwi mnie znacznie bardziej niż groźba wymarcia ludzkości” – mówiła Nature. Tę ostatnią określa jako „straszenie ludzi”.

Powód jest prosty. AI nie musi być potężniejsza od całej ludzkości, żeby wyrządzić szkody. Wystarczy, że poda fałszywą informację w miejscu, w którym ktoś potraktuje ją jako wiarygodną. „Nature” przywołuje doniesienia CNN o raporcie wygenerowanym przez AI, zawierającym fałszywe informacje. Według stacji niemal doprowadziły one w tym roku do wejścia amerykańskich sił na chiński statek. To zupełnie inny rodzaj zagrożenia niż bunt superinteligencji. Nie wymaga samoświadomości, własnych celów ani planu działania. Wystarczy błąd i zbyt duże zaufanie człowieka do systemu.

Niebezpieczny może być też człowiek z AI

Kolejne ryzyko pojawia się, gdy sztuczna inteligencja trafia w ręce kogoś, kto chce wyrządzić szkodę. Modele mogą pomagać w prowadzeniu cyberataków, wyszukiwaniu słabych punktów systemów albo tworzeniu złośliwego kodu. Badacze sprawdzają też, czy zaawansowana AI może ułatwiać ludziom tworzenie broni biologicznej. W takim scenariuszu nie trzeba zakładać, że system ma własne zamiary. To człowiek wyznacza cel, a AI może ułatwić wykonanie zadania.

Dlatego rozmowa o bezpieczeństwie nie musi zaczynać się od pytania, czy maszyna kiedyś „zechce” zniszczyć człowieka. Znacznie bardziej konkretne są pytania o to, do jakich narzędzi powinna mieć dostęp, ile może robić samodzielnie i jak szybko człowiek jest w stanie przerwać jej działanie.

Źródło: Elizabeth Gibney, „Will AI really kill us all? The science behind the hype”, Nature, 2026, doi: 10.1038/d41586-026-02941-3. T

Kategorie

Eksploruj

Ustawienia

Przejdź do treści