211service.com
Nowa sztuczna inteligencja Facebooka do grania w pokera może zrujnować branżę pokera online — więc nie zostanie wydana
grać w karty Jack Hamilton | Unsplash
Poker wymaga umiejętności, która zawsze wydawała się wyjątkowo ludzka: umiejętności bycia przebiegłym. Aby wygrać, gracze muszą przeanalizować, jak grają ich przeciwnicy, a następnie nakłonić ich do oddania swoich żetonów. Oczywiście taka przebiegłość przychodzi ludziom całkiem naturalnie. Teraz program AI po raz pierwszy pokazał, że jest w stanie przechytrzyć cały stół pokerowych profesjonalistów korzystających z podobnych umiejętności.
Zespół z Carnegie Mellon University (CMU) i Facebooka wykorzystał kombinację technik sztucznej inteligencji, aby obstawiać i blefować ludzkich graczy w sześcioosobowej grze Texas Hold’em bez limitu. Każdy z zaangażowanych ludzi wygrał wcześniej ponad milion dolarów przy pokerowym stole – w tym Darren Elias, który jest rekordzistą w większości tytułów World Poker Tour, oraz Chris Jesus Ferguson, który wygrał sześć tytułów World Series of Poker, jako jak również jeden gorszy bot pokerowy.
Nowa sztuczna inteligencja, Pluribus, rozegrała 5000 rozdań przeciwko pokerzystom i konsekwentnie wygrywała więcej niż jej przeciwnicy. W innym teście z udziałem 13 graczy i 10 000 rozdań bot ponownie zwyciężył. Pluribus przyjął kilka zaskakujących strategii, w tym zakłady donk lub zakończenie jednej rundy sprawdzeniem, a następnie rozpoczęcie kolejnej rundy zakładem. Blefował też jak wytrawny zawodowiec.
Algorytm odniósł tak duży sukces, że badacze postanowili nie udostępniać jego kodu z obawy, że mógłby zostać użyty do opróżnienia skarbców internetowych firm pokerowych. To może być bardzo niebezpieczne dla społeczności pokerowej, mówi Noam Brown , badacz Facebooka i były student CMU, który pomógł opracować algorytm. (Brown został w tym roku uznany za jednego z innowatorów MIT Technology Review poniżej 35 roku życia).
Zazwyczaj dowiadujesz się, gdzie twój przeciwnik jest słaby, ale nie znalazłeś słabych punktów, mówi Jason Les , jeden z profesjonalnych pokerzystów w grze. Ta sztuczna inteligencja była tak silna, że nie można było znaleźć niczego, co można by wykorzystać lub wykorzystać.
Les mówi, że radził sobie całkiem nieźle przeciwko AI, ale zasadniczo miał szczęście i informuje, że przyłapało go to na kilkukrotnym blefowaniu. Mówi również, że gracz AI nauczył go kilku sztuczek. Niektóre rzeczy, które widziałem, jak sztuczna inteligencja, otworzyły mi umysł na to, jak grać w pulach „multi-way” [multi-player], mówi.
Gry takie jak szachy i Go stały się standardowym sposobem mierzenia postępów w sztucznej inteligencji (chociaż każda gra obejmuje tylko ograniczony i wąski aspekt tego, co stanowi ludzką spryt). Ale gry, które do tej pory podbiła sztuczna inteligencja, w większości obejmują tylko dwóch graczy, a większość z nich jest rozgrywana w taki sposób, aby ruchy przeciwnika były wyraźnie widoczne. W przeciwieństwie do tego, najbardziej popularne formy pokera obejmują stół z wieloma graczami i wieloma ukrytymi kartami.
To jest oszałamiające, mówi Tuomas Sandholm , profesor Carnegie Mellon, który pomógł rozwinąć Pluribus. Nie sądziłem, że jesteśmy blisko – dopiero rok temu zacząłem wierzyć.
Sandholm i Brown opracowali program AI zdolny do grania w nadludzkiego pokera jeden na jednego w 2017 roku. Wydawało się jednak, że stworzenie programu zdolnego do pokonania kilku graczy byłoby o wiele bardziej złożone, że prawie niemożliwe. W przeciwieństwie do wersji dla dwóch graczy, nie jest jasne, czy wersja dla wielu graczy ma jedną optymalną strategię (tzw. równowaga Nasha).
Następnie, w zeszłym roku, para opracowała technikę bardziej wydajną w eksploracji możliwych permutacji, które towarzyszą każdej świeżo rozdanej karcie. Ponieważ nie jest możliwe rozważenie każdej możliwej ręki lub każdej możliwej strategii, której używa każdy gracz, nowa technika ogranicza wyszukiwanie do łatwego do opanowania podzbioru.
Co ciekawe, podczas gdy poprzednie algorytmy wymagały superkomputera, Pluribus działa na jednym serwerze. Szczegóły badań i gry z ekspertami od pokera, pojawiają się w czasopiśmie Science Dziś.
Przy sześciu graczach jest to o wiele bardziej skomplikowane, że nie można szukać do końca gry, mówi Brown, który jest teraz częścią grupy Facebook Artificial Intelligence Research (FAIR). Kluczem jest algorytm [wyszukiwania].
Osiągnięcie jest ważnym punktem zwrotnym dla sztucznej inteligencji. Program komputerowy musi używać czegoś więcej niż tylko brutalnych obliczeń, aby zwyciężyć w pokerze. Potrzebuje również umiejętności negocjowania w niepewnych okolicznościach, z wykorzystaniem zasad teorii gier.
Techniki stosowane w pokerze mają wiele praktycznych zastosowań, od ustalania cen produktów po kierowanie autonomicznych samochodów przez ruchliwy ruch. Algorytmy strategiczne są również potencjalnie przydatne w kontekstach obronnych. Rzeczywiście, Sandholm ma firmę konsultingową o nazwie Strategy Robot, która pracuje nad projektami obronnymi. Podkreśla jednak, że kod używany do podboju pokera byłby w takich kontekstach bezużyteczny, ponieważ jest specjalnie dostosowany do gry karcianej.
Vincent Conitzer , profesor na Duke University, który specjalizuje się w sztucznej inteligencji i teorii gier, mówi, że ważne będzie sprawdzenie, czy zastosowane techniki można zastosować w innych grach wieloosobowych.
Można by pomyśleć, że poker dla wielu graczy będzie wymagał fundamentalnie różnych technik, mówi Conitzer. Praca rodzi wiele ciekawych pytań dotyczących natury gier i ustawień strategicznych.
Brown mówi, że Facebook nie planuje zastosować technik opracowanych dla sześcioosobowego pokera, chociaż mogłyby zostać wykorzystane do opracowania lepszych gier komputerowych.