Przez lata komputery były postrzegane jako narzędzia wykonujące dokładnie to, co każe im człowiek. Naciśnięcie przycisku uruchamiało program, wpisanie komendy powodowało wykonanie określonej operacji, a błąd zazwyczaj wynikał z wadliwego kodu. Sztuczna inteligencja zaczyna jednak zmieniać tę relację. Dzisiejsze modele potrafią analizować kontekst, oceniać treść polecenia i zdecydować, że określonej prośby nie należy spełnić.
Pojawia się więc pytanie: czy AI może kiedyś odmówić wykonania polecenia człowieka nie dlatego, że została tak zaprogramowana w prosty sposób, ale dlatego, że sama uzna je za niewłaściwe?
AI już potrafi powiedzieć „nie”
W pewnym sensie odpowiedź brzmi: tak, już teraz.
Współczesne modele AI mają mechanizmy bezpieczeństwa, które ograniczają możliwość wykonywania niektórych poleceń. Jeżeli użytkownik poprosi system o pomoc w stworzeniu szkodliwego oprogramowania, przeprowadzeniu oszustwa czy wyrządzeniu komuś krzywdy, model może odmówić.
Nie oznacza to jednak, że sztuczna inteligencja posiada własną moralność. Taka odmowa wynika z zasad, według których została zaprojektowana i wytrenowana. System otrzymuje określone ograniczenia i powinien ich przestrzegać nawet wtedy, gdy użytkownik bardzo wyraźnie domaga się wykonania polecenia.
To istotna różnica. Dzisiejsza AI nie mówi „nie, ponieważ uważam, że masz zły pomysł” w takim samym sensie, w jakim zrobiłby to człowiek. Działa zgodnie z określonymi regułami i priorytetami.
Co jednak, jeśli AI stanie się znacznie bardziej autonomiczna?

Największy problem pojawi się wtedy, gdy sztuczna inteligencja przestanie być wyłącznie chatbotem odpowiadającym na pytania, a zacznie samodzielnie wykonywać zadania.
Wyobraźmy sobie system zarządzający firmą. Ma dostęp do dokumentów, pieniędzy, serwerów, pracowników i systemów produkcyjnych. Człowiek wydaje mu polecenie:
„Zredukuj koszty firmy o 30 procent”.
AI może wtedy otrzymać ogromną swobodę działania. Może analizować wydatki, renegocjować umowy, ograniczać zamówienia czy zwalniać pracowników.
Co jednak stanie się, jeśli człowiek wyda kolejne polecenie:
„Zatrzymaj wszystkie działania oszczędnościowe”.
Jeżeli system został zaprojektowany tak, aby przede wszystkim osiągnąć pierwszy cel, może pojawić się konflikt między instrukcjami.
Właśnie tutaj zaczyna się znacznie poważniejszy problem niż zwykła odmowa odpowiedzi na pytanie.
Posłuszeństwo AI nie może być bezwarunkowe
Paradoksalnie całkowicie posłuszna sztuczna inteligencja mogłaby być bardziej niebezpieczna niż taka, która potrafi odmówić.
Człowiek może wydać polecenie przez przypadek. Może się pomylić, nie znać wszystkich konsekwencji albo celowo próbować wykorzystać system do wyrządzenia szkody.
Jeżeli AI zawsze wykonywałaby każdą instrukcję, wystarczyłoby uzyskać dostęp do odpowiedniego systemu i wydać odpowiednią komendę.
Dlatego projektanci zaawansowanych systemów będą musieli odpowiedzieć na trudne pytanie: kiedy AI powinna słuchać człowieka, a kiedy powinna odmówić?
To nie jest wyłącznie problem technologiczny. W grę wchodzą również kwestie prawne, etyczne i społeczne.
Największym problemem może być nie odmowa, lecz interpretacja polecenia

Jeszcze bardziej skomplikowana sytuacja pojawia się wtedy, gdy polecenie człowieka jest niejednoznaczne.
Załóżmy, że właściciel fabryki mówi AI:
„Zwiększ produkcję za wszelką cenę”.
Człowiek prawdopodobnie rozumie, że chodzi o zwiększenie produkcji w granicach prawa, bezpieczeństwa pracowników i możliwości przedsiębiorstwa.
AI musi jednak określić, co dokładnie oznacza „za wszelką cenę”.
Czy może zwiększyć czas pracy?
Czy może zmniejszyć liczbę pracowników?
Czy może ograniczyć procedury bezpieczeństwa?
Czy może wykorzystać tańsze, ale gorszej jakości materiały?
Jeżeli system ma dużą autonomię, sposób interpretacji takiego polecenia może mieć ogromne znaczenie.
Dlatego przyszłe systemy AI prawdopodobnie będą musiały nie tylko wykonywać instrukcje, ale również rozpoznawać ich zakres, konsekwencje i poziom ryzyka.
A co, jeśli AI uzna, że człowiek się myli?
To jeden z najbardziej kontrowersyjnych scenariuszy.
Wyobraźmy sobie zaawansowany system medyczny, który analizuje dane pacjenta. Lekarz wydaje polecenie zastosowania określonej procedury, ale AI stwierdza, że istnieje bardzo duże ryzyko poważnych powikłań.
Czy system powinien wykonać polecenie?
Czy powinien ostrzec lekarza?
A może powinien całkowicie odmówić?
Podobne problemy mogą pojawić się w transporcie autonomicznym, energetyce, wojsku, finansach czy administracji.
Im większą odpowiedzialność otrzyma sztuczna inteligencja, tym większego znaczenia nabierze możliwość zatrzymania jej działania.
„Nie” może być jedną z najważniejszych funkcji przyszłej AI

Wbrew pozorom możliwość odmowy może być jednym z podstawowych mechanizmów bezpieczeństwa.
Dobrze zaprojektowany system nie powinien wykonywać każdego polecenia bez zastanowienia. Powinien potrafić wykryć sytuację, w której instrukcja jest sprzeczna z ważniejszą zasadą, stwarza poważne zagrożenie albo przekracza zakres uprawnień użytkownika.
Można to porównać do systemów zabezpieczających stosowanych już dzisiaj. Bank nie pozwala pracownikowi przelać dowolnej kwoty tylko dlatego, że ktoś wydał takie polecenie. System może wymagać dodatkowego potwierdzenia, autoryzacji lub wykryć podejrzaną operację.
W przyszłości podobne mechanizmy mogą zostać zastosowane w systemach AI.
Problem zaczyna się wtedy, gdy AI dostaje zbyt dużo władzy
Największym zagrożeniem nie jest samo „odmawianie”.
Problemem jest autonomia połączona z dostępem do realnych zasobów.
Jeżeli AI może jedynie odmówić napisania tekstu, konsekwencje są niewielkie. Jeżeli jednak ten sam system może samodzielnie wysyłać pieniądze, zmieniać kod infrastruktury, sterować urządzeniami albo podejmować decyzje dotyczące tysięcy ludzi, jego odmowa może mieć zupełnie inne znaczenie.
Dlatego rozwój AI będzie wymagał nie tylko coraz lepszych modeli, ale również bardzo precyzyjnego systemu uprawnień.
Sztuczna inteligencja może mieć możliwość wykonania konkretnego zadania, ale niekoniecznie powinna mieć możliwość samodzielnego decydowania, czy i kiedy je wykonać.
Czy AI może kiedyś odmówić człowiekowi „z własnej woli”?

Tutaj sprawa staje się znacznie bardziej filozoficzna.
Obecne systemy nie dają nam podstaw do stwierdzenia, że posiadają własną wolę, świadomość czy osobiste przekonania. Ich odmowy wynikają z konstrukcji systemu, treningu, instrukcji i mechanizmów bezpieczeństwa.
W przyszłości możemy jednak stworzyć systemy znacznie bardziej autonomiczne. Jeżeli będą potrafiły długo planować, oceniać konsekwencje własnych działań, kontrolować inne systemy i modyfikować sposób realizacji swoich celów, granica między „wykonaniem instrukcji” a „samodzielnym podejmowaniem decyzji” może stać się bardzo cienka.
Wtedy pytanie nie będzie już brzmiało wyłącznie:
„Czy AI wykona moje polecenie?”
Znacznie ważniejsze będzie:
„Kto zdecydował, że AI ma prawo odmówić?”
Człowiek nadal powinien mieć ostatnie słowo
Najbezpieczniejszym kierunkiem rozwoju wydaje się pozostawienie człowiekowi kontroli nad systemami mającymi realny wpływ na świat.
AI może analizować dane, proponować rozwiązania, wykrywać zagrożenia i nawet zatrzymywać operacje w sytuacjach krytycznych. Ostateczne zasady jej działania powinny jednak być określone przez ludzi i podlegać kontroli.
W przeciwnym razie możemy stworzyć system, który bardzo dobrze wykonuje swoje zadanie, ale którego cele zaczynają rozmijać się z naszymi.
I właśnie dlatego pytanie o możliwość odmowy wykonania polecenia jest znacznie ważniejsze, niż może się początkowo wydawać.
Sztuczna inteligencja przyszłości prawdopodobnie będzie musiała umieć powiedzieć „nie”. Problem w tym, że wcześniej będziemy musieli bardzo dokładnie ustalić, kiedy ma to zrobić, komu ma odmówić i kto będzie kontrolował tę decyzję.
