211service.com
DeepMinds AI har brukt teamwork for å slå mennesker i et førstepersons skytespill
Kategori: Kunstig intelligens Lagt ut 31. mai
Dyplæringsalgoritmer har allerede mestret spill som Starcraft for å slå mennesker, og nå har de vist at de kan slå seg sammen for å slå oss også.
Nyhetene: I et papir publisert i Science i går viste DeepMind hvordan det hadde sluppet AI-programmer løs i en modifisert versjon av 3D førstepersonsvideospillet Quake III Arena. Teamet brukte en algoritme kalt For the Win, som trener en rekke agenter parallelt ved å bruke forsterkningslæring, teknikken som lar AI lære hvilke taktikker som fungerer og hvilke som ikke gjør det (og som kjente gjorde at DeepMinds AI kunne vinne på Go). Denne gangen ble AI-agenter trent på rundt 450 000 spill av Capture the Flag, det klassiske spillet som involverer å snappe et flagg fra motstanderens base mens du beskytter ditt eget.
Hver agent kunne bare se en førstepersons visning av den labyrintlignende strukturen, akkurat som en menneskelig spiller ville. AI-agentene ble blandet sammen i lag med 40 menneskelige spillere og matchet tilfeldig i spill – både som motstandere og som lagkamerater. For å gjøre det enda vanskeligere, ble kartene generert prosedyremessig, noe som betyr at ingen var like.
Hvordan vinne: Teamene med AI-agenter var konsekvent bedre enn de andre parene og utviklet teamarbeidsstrategier for å hjelpe dem med å vinne, inkludert å følge lagkamerater for å få flere motstandere i viktige øyeblikk og vente i nærheten av fiendens base for å ta et nytt flagg når det dukket opp. Det er en ny video av agentene i aksjon her .
Det er ingen (A)I i teamet: Arbeidet (som først ble publisert på arXiv pre-press siden før fagfellevurdering i fjor) er interessant fordi det er vanskelig å få AI til å samarbeide: samarbeid involverer så mange variabler, og alle AI-agentene lærer uavhengig. Det er utsikter til at noe slikt kan hjelpe roboter å operere i den virkelige verden mer effektivt, med hverandre og med mennesker.
Vi må imidlertid være forsiktige med å ekstrapolere for mye. Spillet var veldig snevert definert, og det er sannsynlig at det samme systemet ikke bare kunne overføres til et annet scenario - bry deg om det virkelige liv. I alle fall samarbeidet ikke AI-agentene egentlig (i hvert fall ikke på den måten mennesker gjør, ved å kommunisere), fortalte Georgia Techs Mark Riedl. New York Times.
For mer om AI-verdenen, registrer deg her for vår ukentlig AI-nyhetsbrev, The Algorithm.