Padł ostatni bastion. AI pokonało ludzkość w grze Stratego

Nie jest łatwo być człowiekiem. Oprócz codziennych trudności dochodzi stałe kwestionowanie naszego potencjału przez sztuczną inteligencję. Tym razem AI dokonało kolejnego przełomu dla siebie, co oznacza porażkę ludzkości. Dekadę po przegranej w AlphaGo, ludzkość musi uznać wyższość algorytmów w potyczce w Stratego.
Stratego
Stratego

Przez ostatnie dekady rozwój komputerów usprawniał cywilizację oraz przyprawiał wytrawnych graczy o siwe włosy. Gdy w 1997 roku komputer Deep Blue od IBM pokonał Garriego Kasparowa, badacze otrzymali wiatr w żagle, który pozwolił na testowanie zdolności i ograniczeń komputerów oraz ich oprogramowania nie tylko na obliczeniach związanych z matematycznymi problemami, ale także i na grach, gdzie testowano elastyczność oprogramowania.

Najgłośniejszym przypadkiem z ostatnich dekad jest zestawienie oprogramowania AlphaGo z Lee Sedolem – posiadaczem 18 tytułów mistrza świata w grze Go. Do historii przejdzie Ruch 37 z partii 2, który okazał się świetnym zagraniem strategicznym. Prawdopodobieństwo jego wykonania wynosiło zaledwie 1 do 10000. To pokazało, że sztuczna inteligencja potrafi na swój sposób wykazać się kreatywnością.

Ostateczny wynik 5-turowej potyczki to 4:1 dla AlphaGo i od tego momentu dla wielu osób sztuczna inteligencja zyskała podstawy do traktowania jej poważnie – czy to jako zagrożenie dla ludzkości, czy jej szansa. Dekadę później upada ostatni przyczółek ludzkich zdolności w grach.

AI pokonuje graczy Stratego. Dlaczego czekaliśmy na to do 2026 roku?

Stratego jest grą planszową o tematyce militarnej, gdzie głównym celem jest zdobycie flagi przeciwnika oraz pozbawienie go możliwości ruchu. Plansza o wymiarach 10×10 pól ma dwa akweny 2×2, gdzie żaden z pionków nie może wejść. Gracze ustawiają swoje pionki o różnej wartości siły (jednostki bojowe) i ilości w pierwszych czterech rzędach i przesuwają się po jednym polu. Każdy z pionków ma rangę od 1 do 10. W przypadku nadepnięcia dwóch pionków z różnych stron na to samo pole wygrywa ten, który ma większą siłę.

Stratego ma więcej niż 1033 (33 zera) kombinacji początkowych gry. Wartością ruchu nie jest sam ruch, ale też i blef, jaki można zastosować w trakcie rozgrywki. Ataraxos to system stworzony przez uczonych z MIT, Uniwersytetu Carnegie Mellon, Uniwersytetu Stanforda oraz Uniwersytetu Nowojorskiego. Ukończył 163 miliony partii rozgrywki, by stworzyć idealną strategię na ułożenie i poruszanie jednostkami. Następnie zestawiono go z Pimem Niemeijerem – czterokrotnym mistrzem świata.

Stratego - pionki
Gra w Stratego wymaga zdolności blefowania (fot. Wikimedia Commons)

Mecz składał się z 20 partii. Ataxaros wygrał 15 z nich, 4 zremisował i przegrał tylko w jednym starciu. To wynik podobny do tego sprzed roku, gdy w 40 pokazowych grach na Mistrzostwach Świata, oprogramowanie było górą w 38 potyczkach. AI wykorzystało planowanie w czasie rzeczywistym oparte w znacznym stopniu na obserwowaniu zachowań rywala. Następnie model generatywny rozważał wszystkie scenariusze i to, jakie figury może wykrywać przeciwnik. To wystarczyło, by skutecznie blefować i ryzykować.

Czytaj także: Dwie gwiazdy neutronowe tworzą coś, czego astronomowie jeszcze nie widzieli

Co ciekawe, tak zaawansowany system nie kosztował wiele podczas rozgrywki. W przeciwieństwie do rozwiązania sprzed 4 lat od Google DeepMind, Ataraxos potrzebował ułamka mocy systemu DeepNash, a koszt wytrenowania zamknął się w około 8 tysiącach dolarów. Do tego system Ataraxos jest w pewnym sensie elastyczny – doskonale radzi sobie z grą karcianą Hanabi, odmianą Barrage Stratego oraz Dou Dizhu – popularną w Chinach grą opartą o niepełną informację.

Ludzkość musi skupić się na tworzeniu AI zgodnej z jej celami

Sztuczna inteligencja wydaje się być na fali wznoszącej. Na jej rozwój płyną miliardy dolarów, a spór o jej kształt dotyczy wielu graczy na całym świecie. Nawet gdy ci będący na czele stawki mówią o tym, że rozwój AI musi zwolnić, rządzący największymi gospodarkami świata niekoniecznie się z tym zgadzają. Wyścig po superinteligencję sprawia, że dotychczasowe sygnały alarmowe stają się nową normalnością, a informacyjny szum wokół AI działa tylko na korzyść tych, którzy zyskują na niej miliardy dolarów.

Czytaj także: HONOR Robot Phone z bliska. Jest dziwny, odważny i fascynujący. I właśnie tego brakowało smartfonom

W obliczu tego wszystkiego wygrana w Stratego, choć istotna, nie jest już tak wielkim wydarzeniem, jak byłaby na przykład przed dekadą. Podobnie niewiele wątpliwości wzbudza fakt, że modele sztucznej inteligencji potrafią dokonywać cudów w odwróconej inżynierii i łączyć ze sobą dwie gry napisane na zupełnie różnej bazie kodu. W tym wszystkim wygrana nad ludzkością w Stratego i to w cenie około 8 tysięcy dolarów za trening to niby nic wielkiego, ale i pokaz tego, jak bardzo musimy pilnować, by sztuczna inteligencja służyła naszym celom. Inaczej nauczy się blefować na tyle dobrze, by jakiekolwiek nadzieję na jej służbę ludzkości upadły.

Napisane przez

Michał Mielnik

Redaktor