211service.com
En AI trener rådgivere til å håndtere tenåringer i krise
Ms Tech | Unsplash, Pexels
Rådgivere som jobber frivillig ved Trevor-prosjektet må være forberedt på sin første samtale med en LHBTQ-tenåring som kanskje tenker på selvmord. Så først øver de. En av måtene de gjør det på er ved å snakke med fiktive personer som Riley, en 16-åring fra North Carolina som føler seg litt nedstemt og deprimert. Med et teammedlem som spiller Rileys rolle, kan traineer bore i hva som skjer: de kan avdekke at tenåringen er engstelig for å komme ut til familien, nylig fortalte venner og det gikk dårlig, og har opplevd selvmordstanker før, om ikke kl. øyeblikket.
Nå blir Riley imidlertid ikke spilt av en Trevor Project-ansatt, men blir i stedet drevet av AI.
Akkurat som den originale personaen, må denne versjonen av Riley – trent på tusenvis av tidligere transkripsjoner av rollespill mellom rådgivere og organisasjonens ansatte – fortsatt lokkes litt for å åpne seg, og legge ut en situasjon som kan teste hva traineer har lært om de beste måtene å hjelpe LHBTQ-tenåringer.
Rådgivere skal ikke presse Riley til å komme ut. Målet er i stedet å validere Rileys følelser og, om nødvendig, bidra til å utvikle en plan for å holde seg trygg.
Krisetelefoner og chat-tjenester gjør dem til et grunnleggende løfte: Ta kontakt, så kobler vi deg til et ekte menneske som kan hjelpe. Men behovet kan overgå kapasiteten til selv de mest vellykkede tjenestene. Trevor-prosjektet mener at 1,8 millioner LHBTQ-ungdom i Amerika seriøst vurderer selvmord hvert år. De eksisterende 600 rådgiverne for deres chat-baserte tjenester kan ikke håndtere det behovet. Det er grunnen til at gruppen – i likhet med et økende antall organisasjoner for mental helse – vendte seg til AI-drevne verktøy for å møte etterspørselen. Det er en utvikling som gir mye mening, samtidig som det reiser spørsmål om hvor godt dagens AI-teknologi kan prestere i situasjoner der livene til sårbare mennesker står på spill.
Å ta risiko – og vurdere dem
Trevor-prosjektet tror det forstår denne balansen – og understreker hva Riley ikke gjør.
Vi har ikke satt oss for å designe et AI-system som vil ta plassen til en rådgiver, eller som vil direkte samhandle med en person som kan være i krise, sier Dan Fichter, organisasjonens leder for AI og engineering. Denne menneskelige forbindelsen er viktig i alle psykiske helsetjenester, men den kan være spesielt viktig for menneskene Trevor-prosjektet betjener. I følge organisasjonens egen forskning i 2019 var LHBTQ-ungdom med minst én aksepterende voksen i livet. 40 % mindre sannsynlig å rapportere et selvmordsforsøk i året før.
Det AI-drevne treningsrollespillet, kalt krisekontaktsimulatoren og støttet av penger og teknisk hjelp fra Google, er det andre prosjektet organisasjonen har utviklet på denne måten: den bruker også en maskinlæringsalgoritme for å finne ut hvem som har størst risiko av fare. (Den prøvde flere andre tilnærminger, inkludert mange som ikke brukte AI, men algoritmen ga ganske enkelt de mest nøyaktige spådommene for hvem som opplevde det mest presserende behovet.)
AI-drevet risikovurdering er ikke nytt for selvmordsforebyggende tjenester: Department of Veterans Affairs bruker også maskinlæring for å identifisere utsatte veteraner i sin kliniske praksis, ettersom Det rapporterte New York Times sent i fjor.
Meningene varierer om nytten, nøyaktigheten og risikoen ved å bruke AI på denne måten. I spesifikke miljøer kan AI være mer nøyaktig enn mennesker når det gjelder å vurdere folks selvmordsrisiko, hevder Thomas Joiner, en psykologiprofessor ved Florida State University som studerer selvmordsatferd. I den virkelige verden, med flere variabler, ser AI ut til å prestere omtrent like bra som mennesker. Det den imidlertid kan gjøre, er å vurdere flere mennesker raskere.
Derfor er det best brukt til å hjelpe menneskelige rådgivere, ikke erstatte dem. Trevor-prosjektet er fortsatt avhengig av at mennesker utfører full risikovurdering av unge mennesker som bruker tjenestene deres. Og etter at rådgivere er ferdige med rollespillene sine med Riley, blir disse transkripsjonene gjennomgått av et menneske.
Hvordan systemet fungerer
Krisekontaktsimulatoren ble utviklet fordi det å gjøre rollespill tar mye tid og er begrenset til normal arbeidstid, selv om et flertall av rådgiverne planlegger frivillig arbeid i natt- og helgevakter. Men selv om målet var å trene opp flere rådgivere raskere, og bedre imøtekomme frivillige tidsplaner, var ikke effektivitet den eneste ambisjonen. Utviklerne ønsket fortsatt at rollespillet skulle føles naturlig, og at chatboten raskt skulle tilpasse seg en frivilligs feil. Naturlig-språk-behandling algoritmer , som nylig hadde blitt veldig god til å etterligne menneskelige samtaler, virket som en god passform for utfordringen. Etter å ha testet flere alternativer, slo Trevor-prosjektet seg opp OpenAIs GPT-2-algoritme .
Relatert historie
OpenAIs nye språkgenerator GPT-3 er sjokkerende bra – og fullstendig tankeløs AI er den største språkmodellen som noen gang er laget og kan generere utrolig menneskelignende tekst på forespørsel, men vil ikke bringe oss nærmere ekte intelligens.
Chatboten bruker GPT-2 for sine grunnleggende samtaleevner. Den modellen er trent på 45 millioner sider fra nettet, som lærer den grunnleggende strukturen og grammatikken til det engelske språket. Trevor-prosjektet trente det deretter videre på alle transkripsjonene av tidligere Riley-rollespillsamtaler, som ga boten materialet den trengte for å etterligne personaen.
Gjennom hele utviklingsprosessen ble teamet overrasket over hvor godt chatboten presterte. Det er ingen database som lagrer detaljer om Rileys bio, men chatboten forble konsekvent fordi hver transkripsjon gjenspeiler den samme historien.
Men det er også avveininger ved bruk av AI, spesielt i sensitive sammenhenger med sårbare miljøer. GPT-2, og andre naturlige språkalgoritmer som det, er kjent for å bygge inn dypt rasistiske, sexistiske og homofobiske ideer. Mer enn én chatbot har blitt ført katastrofalt på villspor på denne måten, den siste er en sørkoreansk chatbot kalt Lee Luda som hadde personaen til en 20 år gammel universitetsstudent. Etter raskt å ha vunnet popularitet og samhandlet med flere og flere brukere, begynte den å bruke utsagn for å beskrive de skeive og funksjonshemmede samfunnene.
Trevor-prosjektet er klar over dette og utviklet måter å begrense potensialet for problemer. Mens Lee Luda var ment å snakke med brukere om hva som helst, er Riley veldig smalt fokusert. Frivillige vil ikke avvike for langt fra samtalene de har blitt trent på, noe som minimerer sjansene for uforutsigbar oppførsel.
Dette gjør det også lettere å utførlig teste chatboten, noe Trevor Project sier de gjør. Disse brukstilfellene som er svært spesialiserte og veldefinerte, og designet inkluderende, utgjør ikke en veldig høy risiko, sier Nenad Tomasev, en forsker ved DeepMind.
Menneske til menneske
Dette er ikke første gang feltet psykisk helse har forsøkt å utnytte AIs potensiale til å gi inkluderende, etisk hjelp uten å skade menneskene det er laget for å hjelpe. Forskere har utviklet lovende måter å oppdage depresjon fra en kombinasjon av visuelle og auditive signaler. Terapiroboter, selv om de ikke tilsvarer en menneskelig profesjonell, blir slått opp som alternativer for de som ikke har tilgang til en terapeut eller er ubehagelige betro seg til en person.
Hver av disse utviklingene, og andre lignende, krever at man tenker på hvor mye agent AI-verktøy skal ha når det gjelder å behandle sårbare mennesker. Og konsensus ser ut til å være at på dette tidspunktet er ikke teknologien egentlig egnet til å erstatte menneskelig hjelp.
Likevel sier Joiner, psykologiprofessoren, at dette kan endre seg over tid. Selv om det for øyeblikket er en dårlig idé å erstatte menneskelige rådgivere med AI-kopier, betyr det ikke at det er en begrensning som er permanent, sier han. Mennesker, har kunstige vennskap og relasjoner med AI-tjenester allerede . Så lenge folk ikke blir lurt til å tro at de har en diskusjon med et menneske når de snakker med en AI, sier han, kan det være en mulighet i etterkant.
I mellomtiden vil Riley aldri møte ungdommene som faktisk sender meldinger til Trevor-prosjektet: det vil alltid fungere som et treningsverktøy for frivillige. Menneske-til-menneske-forbindelsen mellom våre rådgivere og menneskene som når ut til oss er avgjørende for alt vi gjør, sier Kendra Gaunt, gruppens data- og AI-produktleder. Jeg tror det gjør oss virkelig unike, og noe som jeg ikke tror noen av oss ønsker å erstatte eller endre.
Korreksjon: Vi endret en setning som sa at Trevor-prosjektet prøvde ut to algoritmer for chatboten sin. Den prøvde flere.