DeepMinds banebrytende AlphaGo Zero AI er nå en allsidig spiller

Kategori: Kunstig intelligens Lagt ut 06. desember

Ikke utfordre denne algoritmen til et brettspill. Fordi sjansen er stor for at den kan lære å overliste deg i løpet av en dag.





Tidligere i år rapporterte vi at Alphabets datterselskap for maskinlæring, DeepMind, hadde gjort et stort fremskritt. Ved å bruke en kunstig intelligens-tilnærming kjent som forsterkende læring, hadde den gjort det mulig for AlphaGo-programvaren å utvikle overmenneskelige ferdigheter for spillet Go uten å trenge menneskelige data. Bevæpnet med bare spillereglene, var AI i stand til å gjøre tilfeldige spill helt til den utviklet strategier for å slå mester. Den nye programvaren ble kalt AlphaGo Zero fordi den ikke trengte noen menneskelig input.

Nå i en artikkel publisert på arXiv , rapporterer DeepMind-teamet at programvaren har blitt generalisert slik at den kan lære andre spill. Den beskriver to nye eksempler der AlphaGo Zero ble sluppet løs i spillene sjakk og shogi, et japansk spill som ligner på sjakk. I begge tilfeller var programvaren i stand til å utvikle overmenneskelige ferdigheter innen 24 timer, og beseiret deretter et verdensmesterprogram på en overbevisende måte.

Det er kanskje ikke så overraskende at AI var i stand til å fange opp morderferdigheter for de to spillene så raskt: både sjakk og shogi er mindre komplekse enn Go. Men DeepMinds evne til å generalisere programvaren, slik at den kan mestre forskjellige spill, antyder stadig mer tilpasningsdyktige typer maskinintelligens.



Når det er sagt, er det fortsatt spill som AI ennå ikke har mestret. Den kanskje største utfordringen – som DeepMind allerede jobber med – ligger i massivt komplekse online strategispill som Starcraft, som mennesker fortsatt er overlegne i . Som vi har forklart tidligere, må maskiner utvikle nye ferdigheter, for eksempel hukommelse og planlegging, for å stjele bort den kronen. Men ikke forvent at det tar for lang tid.