Przez ostatnie dekady rozwój komputerów usprawniał cywilizację oraz przyprawiał wytrawnych graczy o siwe włosy. Gdy w 1997 roku komputer Deep Blue od IBM pokonał Garriego Kasparowa, badacze otrzymali wiatr w żagle, który pozwolił na testowanie zdolności i ograniczeń komputerów oraz ich oprogramowania nie tylko na obliczeniach związanych z matematycznymi problemami, ale także i na grach, gdzie testowano elastyczność oprogramowania.
Najgłośniejszym przypadkiem z ostatnich dekad jest zestawienie oprogramowania AlphaGo z Lee Sedolem – posiadaczem 18 tytułów mistrza świata w grze Go. Do historii przejdzie Ruch 37 z partii 2, który okazał się świetnym zagraniem strategicznym. Prawdopodobieństwo jego wykonania wynosiło zaledwie 1 do 10000. To pokazało, że sztuczna inteligencja potrafi na swój sposób wykazać się kreatywnością.
Ostateczny wynik 5-turowej potyczki to 4:1 dla AlphaGo i od tego momentu dla wielu osób sztuczna inteligencja zyskała podstawy do traktowania jej poważnie – czy to jako zagrożenie dla ludzkości, czy jej szansa. Dekadę później upada ostatni przyczółek ludzkich zdolności w grach.
AI pokonuje graczy Stratego. Dlaczego czekaliśmy na to do 2026 roku?
Stratego jest grą planszową o tematyce militarnej, gdzie głównym celem jest zdobycie flagi przeciwnika oraz pozbawienie go możliwości ruchu. Plansza o wymiarach 10×10 pól ma dwa akweny 2×2, gdzie żaden z pionków nie może wejść. Gracze ustawiają swoje pionki o różnej wartości siły (jednostki bojowe) i ilości w pierwszych czterech rzędach i przesuwają się po jednym polu. Każdy z pionków ma rangę od 1 do 10. W przypadku nadepnięcia dwóch pionków z różnych stron na to samo pole wygrywa ten, który ma większą siłę.
Stratego ma więcej niż 1033 (33 zera) kombinacji początkowych gry. Wartością ruchu nie jest sam ruch, ale też i blef, jaki można zastosować w trakcie rozgrywki. Ataraxos to system stworzony przez uczonych z MIT, Uniwersytetu Carnegie Mellon, Uniwersytetu Stanforda oraz Uniwersytetu Nowojorskiego. Ukończył 163 miliony partii rozgrywki, by stworzyć idealną strategię na ułożenie i poruszanie jednostkami. Następnie zestawiono go z Pimem Niemeijerem – czterokrotnym mistrzem świata.

Mecz składał się z 20 partii. Ataxaros wygrał 15 z nich, 4 zremisował i przegrał tylko w jednym starciu. To wynik podobny do tego sprzed roku, gdy w 40 pokazowych grach na Mistrzostwach Świata, oprogramowanie było górą w 38 potyczkach. AI wykorzystało planowanie w czasie rzeczywistym oparte w znacznym stopniu na obserwowaniu zachowań rywala. Następnie model generatywny rozważał wszystkie scenariusze i to, jakie figury może wykrywać przeciwnik. To wystarczyło, by skutecznie blefować i ryzykować.
Czytaj także: Dwie gwiazdy neutronowe tworzą coś, czego astronomowie jeszcze nie widzieli
Co ciekawe, tak zaawansowany system nie kosztował wiele podczas rozgrywki. W przeciwieństwie do rozwiązania sprzed 4 lat od Google DeepMind, Ataraxos potrzebował ułamka mocy systemu DeepNash, a koszt wytrenowania zamknął się w około 8 tysiącach dolarów. Do tego system Ataraxos jest w pewnym sensie elastyczny – doskonale radzi sobie z grą karcianą Hanabi, odmianą Barrage Stratego oraz Dou Dizhu – popularną w Chinach grą opartą o niepełną informację.
Ludzkość musi skupić się na tworzeniu AI zgodnej z jej celami
Sztuczna inteligencja wydaje się być na fali wznoszącej. Na jej rozwój płyną miliardy dolarów, a spór o jej kształt dotyczy wielu graczy na całym świecie. Nawet gdy ci będący na czele stawki mówią o tym, że rozwój AI musi zwolnić, rządzący największymi gospodarkami świata niekoniecznie się z tym zgadzają. Wyścig po superinteligencję sprawia, że dotychczasowe sygnały alarmowe stają się nową normalnością, a informacyjny szum wokół AI działa tylko na korzyść tych, którzy zyskują na niej miliardy dolarów.
Czytaj także: HONOR Robot Phone z bliska. Jest dziwny, odważny i fascynujący. I właśnie tego brakowało smartfonom
W obliczu tego wszystkiego wygrana w Stratego, choć istotna, nie jest już tak wielkim wydarzeniem, jak byłaby na przykład przed dekadą. Podobnie niewiele wątpliwości wzbudza fakt, że modele sztucznej inteligencji potrafią dokonywać cudów w odwróconej inżynierii i łączyć ze sobą dwie gry napisane na zupełnie różnej bazie kodu. W tym wszystkim wygrana nad ludzkością w Stratego i to w cenie około 8 tysięcy dolarów za trening to niby nic wielkiego, ale i pokaz tego, jak bardzo musimy pilnować, by sztuczna inteligencja służyła naszym celom. Inaczej nauczy się blefować na tyle dobrze, by jakiekolwiek nadzieję na jej służbę ludzkości upadły.

