Dlaczego poker to wielka sprawa dla sztucznej inteligencji?





Jak powiedział kiedyś wielki Kenny Rogers, dobry hazardzista musi wiedzieć, kiedy je trzymać i kiedy spasować. W tym tygodniu w kasynie Rivers w Pittsburghu program komputerowy o nazwie Libratus może wreszcie udowodnić, że komputery potrafią to robić lepiej niż jakikolwiek gracz w karty.

Libratus gra w tysiącach gier heads-up lub dwóch graczy, no-limit Texas hold'em, przeciwko kilku doświadczonym profesjonalnym pokerzystom. Teraz nieco ponad w połowie 20-dniowego konkursu Libratus ma prawie 800 000 $ w porównaniu ze swoimi ludzkimi przeciwnikami. Tak więc zwycięstwo, choć dalekie od gwarantowanego, może leżeć w kartach.

Wygrana dla Libratusa byłaby ogromnym osiągnięciem w dziedzinie sztucznej inteligencji. Poker wymaga rozumowania i inteligencji, które okazały się trudne do naśladowania dla maszyn. Zasadniczo różni się od warcabów, szachów lub go, ponieważ ręka przeciwnika pozostaje niewidoczna podczas gry. W grach z niedoskonałymi informacjami niezwykle skomplikowane jest ustalenie idealnej strategii, biorąc pod uwagę każde możliwe podejście, jakie może przyjąć twój przeciwnik. No-limit Texas Hold'em jest szczególnie trudny, ponieważ przeciwnik może w zasadzie postawić dowolną kwotę.



Poker to jedna z najtrudniejszych gier do zgryzienia przez sztuczną inteligencję, mówi Andrzej Ng , główny naukowiec w Baidu. Nie ma jednego optymalnego ruchu, ale zamiast tego gracz AI musi losować swoje działania, aby przeciwnicy byli niepewni, kiedy blefuje.

Libratus został stworzony przez Tuomas Sandholm , profesor na wydziale informatyki CMU i jego doktorant Noam Brown . Sandholm, ekspert w dziedzinie teorii gier i sztucznej inteligencji, który wyemigrował z Finlandii w celu uzyskania doktoratu, mówi, że to zdumiewające, że ludzie tak długo potrafili ogrywać komputery. Po prostu uderza mnie w głowę, jak dobrzy są ci najlepsi profesjonaliści” – mówi. „Ze wszystkich tych gier, z którymi zmagała się sztuczna inteligencja, [poker] jest jedyną, w której sztuczna inteligencja nie osiągnęła nadludzkiej wydajności.

Badacze sztucznej inteligencji wykorzystują teorię gier lub matematykę strategicznego podejmowania decyzji, aby znaleźć najlepszą strategię, biorąc pod uwagę różne niepewności, znane jako równowaga. Ponieważ możliwości są tak ogromne, zwykle wiąże się to z pewną formą przybliżenia.

To, czy ruch jest dobry, czy nie, zależy od rzeczy, których nie można zaobserwować, mówi Vincent Conitzer , profesor na Duke University, który wykłada sztuczną inteligencję i teorię gier. Skutkuje to również koniecznością bycia nieprzewidywalnym. Jeśli nigdy nie blefujesz, nie jesteś dobrym graczem. Jeśli zawsze blefujesz, nie jesteś dobrym graczem. Teoria gier mówi ci, jak zrandomizować swoją grę w sposób, który jest w pewnym sensie optymalny.

W zeszłym roku Sandholm kierował rozwojem poprzedniego programu do gry w pokera, zwanego Claudico, który został mocno pokonany w meczu z kilkoma profesjonalnymi pokerzystami. Wyjaśnia, że ​​Libratus wykorzystuje kilka nowych rozwiązań, aby osiągnąć tak wysoki poziom gry. Obejmuje to nową technikę aproksymacji równowagi, mówi Sandholm, a także kilka nowych metod analizowania możliwych wyników w miarę odkrywania kart na późniejszych etapach gry. Ta analiza końca gry jest bardzo trudna pod względem obliczeniowym i jest przeprowadzana podczas każdej gry w Pittsburgh Supercomputing Center, obiekcie obsługiwanym przez CMU i University of Pittsburgh.

Dzięki postępom w uczeniu maszynowym i sztucznej inteligencji pojawiło się ostatnio wiele nadludzkich programów do grania. W zeszłym roku badacze z DeepMind, spółki zależnej Alphabet, opracowali program, który jest w stanie pokonać jednego z najlepszych graczy Go na świecie. To osiągnięcie było tak spektakularne, ponieważ Go jest niezwykle złożone i trudno jest zmierzyć postęp w grze (patrz Google AI Masters Go dekadę wcześniej niż oczekiwano).

Kilka różnych grup badawczych skupia się na walce z pokerem. Inny zespół akademicki, z University of Alberta w Kanadzie oraz Charles University i Czech Technical University w Czechach, opracował niedawno program o nazwie Głęboki stos , która pokonała już kilku profesjonalnych graczy w heads-up no-limit Texas hold'em (patrz Poker to najnowsza gra, w której można spasować przeciwko AI ). Sandholm mówi jednak, że gracze biorący udział w meczu z Libratus są znacznie silniejsi i rozgrywają o wiele więcej rozdań przeciwko maszynie, co powinno zapewnić większą istotność statystyczną wyniku.

Techniki użyte do zbudowania inteligentniejszego bota pokerowego mogą mieć wiele zastosowań w świecie rzeczywistym. Twierdzi, że teoria gier została już zastosowana do badań nad atakami zakłócającymi i cyberbezpieczeństwem, automatycznymi wskazówkami dla usług taksówkarskich i planowaniem robotów Sam Ganzfried , który był zaangażowany w rozwój Claudico, a obecnie jest adiunktem na Florida International University w Miami.

Jednak nawet jeśli Libratus triumfuje w tym tygodniu, nie oznacza to, że ludzie nie zasługują już na miejsce przy stole karcianym. Wieloosobowej wersji Texas hold’em no-limit nie da się opanować przy użyciu technik stosowanych przez Libratus.

ukryć