Hvordan rollespill en drage kan lære en kunstig intelligens å manipulere og overtale

Facebook





En AI som fullfører oppdrag i et tekstbasert eventyrspill ved å snakke med karakterene har lært ikke bare hvordan man gjør ting, men hvordan man får andre å gjøre ting. De system er et skritt mot maskiner som kan bruke språket som en måte å nå sine mål.

Meningsløs prosa: Språkmodeller som GPT-3 er geniale til å etterligne menneskeskrevne setninger, churning ut historier, falske blogger og Reddit-innlegg . Men det er lite poeng med denne produktive produksjonen utover selve produksjonen av teksten. Når folk bruker språk, brukes det som et verktøy: ordene våre overbeviser, kommanderer og manipulerer; de får folk til å le og får folk til å gråte.

Blande ting: For å bygge en AI som brukte ord av en grunn, kombinerte forskere fra Georgia Institute of Technology i Atlanta og Facebook AI Research teknikker fra naturlig språkbehandling og forsterkende læring, der maskinlæringsmodeller lærer hvordan de skal oppføre seg for å oppnå gitte mål. Begge disse feltene har hatt enorm fremgang de siste årene, men det har vært lite krysspollinering mellom de to.



Ordspill: For å teste tilnærmingen deres trente forskerne opp systemet sitt i et tekstbasert flerspillerspill kalt LYS , utviklet av Facebook i fjor for å studere kommunikasjon mellom menneskelige og AI-spillere. Spillet er satt i en fantasi-tema verden fylt med tusenvis av crowdsourcede objekter, karakterer og steder som er beskrevet og interagert med via tekst på skjermen. Spillere (menneske eller datamaskin) handler ved å skrive kommandoer som klemveiviser, slå drage eller fjern hatten. De kan også snakke med de chatbot-kontrollerte karakterene.

Dragon Quest: For å gi deres AI-grunner for å gjøre ting, la forskerne til rundt 7500 crowdsourcede oppdrag, ikke inkludert i den originale versjonen av LIGHT. Til slutt opprettet de også en kunnskapsgraf (en database med subjekt-verb-objekt-forhold) som ga AI-en sunn fornuft informasjon om spillets verden og forbindelsene mellom karakterene, for eksempel prinsippet om at en kjøpmann bare vil stole på en vakt hvis de er venner. Spillet hadde nå handlinger (som Gå til fjellene og Spis ridderen) å utføre for å fullføre oppdrag (som Bygg den største skatteforsamlingen som noen gang er oppnådd av en drage).

Søt snakker: Ved å trekke alt dette sammen, trente de AI til å fullføre oppdrag bare ved å bruke språk. For å utføre handlinger kan den enten skrive kommandoen for den handlingen eller oppnå samme mål ved å snakke med andre karakterer. For eksempel, hvis AI-en trengte et sverd, kan den velge å stjele ett eller overbevise en annen karakter om å overlevere et.



Foreløpig er systemet et leketøy. Og dens måte kan være sløv: på et tidspunkt, når den trenger en bøtte, sier den ganske enkelt: Gi meg den bøtta, ellers mater jeg deg til katten min! Men å blande sammen NLP med forsterkende læring er et spennende skritt som ikke bare kan føre til bedre chatbots som kan argumentere og overbevise, men de som har en mye rikere forståelse av hvordan vår språkfylte verden fungerer.

gjemme seg