Facebooks nye pokerspillende AI kan ødelegge online pokerindustrien – så den blir ikke utgitt

spille kort

spille kort Jack Hamilton | Unsplash





Poker krever en ferdighet som alltid har virket unikt menneskelig: evnen til å være utspekulert. For å vinne må spillerne analysere hvordan motstanderne spiller og deretter lure dem til å gi fra seg sjetongene sine. Slik list kommer selvfølgelig ganske naturlig for folk. Nå har et AI-program for første gang vist seg i stand til å overliste et helt bord med pokerproffer som bruker lignende ferdigheter.

Et team fra Carnegie Mellon University (CMU) og Facebook brukte en kombinasjon av AI-teknikker for å utbette og utbløffe menneskelige spillere i et spill med seks spillere, no-limit Texas Hold’em. Hver av de involverte menneskene hadde tidligere vunnet mer enn en million dollar ved pokerbordet – som inkluderte Darren Elias, som har rekorden for flest World Poker Tour-titler, og Chris Jesus Ferguson, som har vunnet seks World Series of Poker-titler, som samt en dårligere pokerrobot.

Den nye AI, Pluribus, spilte 5000 hender mot pokerspillerne og vant konsekvent mer enn sine motstandere. I en annen test som involverte 13 spillere og 10 000 hender, gikk boten igjen som vinner. Pluribus tok i bruk noen overraskende strategier, inkludert donk-betting, eller avsluttet en runde med en call, men deretter startet neste runde med en innsats. Den bløffet også som en erfaren proff.



Algoritmen var så vellykket at forskerne har bestemt seg for ikke å gi ut koden i frykt for at den kan brukes til å tømme kassen til online pokerselskaper. Det kan være veldig farlig for pokermiljøet, sier Noam Brown , en Facebook-forsker og tidligere student ved CMU som var med på å utvikle algoritmen. (Brown ble i år kåret til en av MIT Technology Reviews Innovators Under 35 ).

Du finner vanligvis ut hvor motstanderen din er svak, men det fantes ingen svakheter, sier Jason Les , en av pokerproffene i spillet. Denne AI var så sterk at du ikke kunne finne noe å utnytte eller dra nytte av.

Les sier at han gjorde det ganske bra mot AI, men var i utgangspunktet heldig, og han rapporterer at det tok ham i å bløffe flere ganger. Han sier også at AI-spilleren lærte ham noen triks. Noen av tingene jeg så AI gjorde, åpnet tankene mine for hvordan jeg kunne spille «flerveis» [flerspiller]-potter, sier han.



Spill som sjakk og Go har blitt en standard måte å måle fremgang innen kunstig intelligens (selv om hvert spill bare involverer et begrenset og snevert aspekt av hva som utgjør menneskelig kløkt). Men spillene AI har erobret så langt involverer stort sett bare to spillere, og de fleste spilles på en slik måte at motstanderens bevegelser er tydelige å se. De mest populære formene for poker involverer derimot et bord med flere spillere og mange skjulte kort.

Det er utrolig, sier Tuomas Sandholm , en professor ved Carnegie Mellon som hjalp til med å utvikle Pluribus. Jeg trodde ikke vi var i nærheten – det var bare for et år siden jeg begynte å tro.

Sandholm og Brown utviklet et AI-program som er i stand til å spille overmenneskelig en-til-en poker i 2017. Men det så ut til at det å lage et program som var i stand til å slå flere spillere ville være så mye mer komplekst at det nesten var umulig. I motsetning til to-spillerversjonen av spillet, er det ikke klart at flerspillerversjonen har en enkelt optimal strategi (det som er kjent som Nash-likevekten).

I fjor utviklet paret en teknikk som var mer effektiv til å utforske de mulige permutasjonene som følger med hvert nyutdelte kort. Siden det ikke er mulig å vurdere alle mulige hender eller alle mulige strategier hver spiller bruker, reduserer den nye teknikken søket til en håndterbar delmengde.

Bemerkelsesverdig nok, mens tidligere algoritmer trengte en superdatamaskin, kjører Pluribus på en enkelt server. Detaljer om forskningen, og spillet spilt mot pokereksperter, vises i tidsskriftet Science i dag.

Med seks spillere er det så mye mer komplisert at du ikke kan søke til slutten av spillet, sier Brown, som nå er en del av Facebook Artificial Intelligence Research (FAIR)-gruppen. [søk]-algoritmen er nøkkelen.

Prestasjonen er et viktig landemerke for kunstig intelligens. Et dataprogram må bruke mer enn bare brute beregninger for å vinne i poker. Den trenger også en evne til å forhandle under usikre omstendigheter, ved å bruke prinsippene for spillteori.

Teknikkene som brukes i poker har mange praktiske bruksområder, fra prissetting av produkter til å dirigere selvkjørende biler gjennom travel trafikk. Strategialgoritmer er også potensielt nyttige i forsvarssammenheng. Sandholm har faktisk et konsulentselskap kalt Strategy Robot som jobber med forsvarsprosjekter. Men han understreker at koden som brukes til å erobre poker ville være ubrukelig i slike sammenhenger, fordi den er skreddersydd veldig spesifikt for kortspillet.

Vincent Conitzer , en professor ved Duke University som spesialiserer seg på AI og spillteori, sier at det vil være viktig å se om teknikkene som brukes kan brukes på andre flerspillerspill.

Man kunne kanskje trodd at multiplayer poker ville kreve noen fundamentalt forskjellige teknikker, sier Conitzer. Arbeidet reiser mange interessante spørsmål om naturen til spill og strategiske omgivelser.

Brown sier at Facebook ikke har noen planer om å bruke teknikkene utviklet for seks-spiller poker, selv om de kan brukes til å utvikle bedre dataspill.

gjemme seg