En hybrid AI-modell lar den resonnere om verdens fysikk som et barn

Kategori: Kunstig intelligens Lagt ut 06 mars En rød gummikule treffer en blå gummisylinder som fortsetter å treffe en metallsylinder. En rød gummikule treffer en blå gummisylinder som fortsetter å treffe en metallsylinder.





Et nytt datasett avslører hvor dårlig AI er til å resonnere – og antyder at en ny hybrid tilnærming kan være den beste veien videre.

Spørsmål, spørsmål: Kjent som CLEVRER, datasettet består av 20 000 korte syntetiske videoklipp og mer enn 300 000 spørsmål og svar-sammenkoblinger som begrunner hendelsene i videoene. Hver video viser en enkel verden av lekeobjekter som kolliderer med hverandre etter simulert fysikk. I den ene treffer en rød gummikule en blå gummisylinder, som fortsetter å treffe en metallsylinder.

Spørsmålene faller inn i fire kategorier: beskrivende (f.eks. Hvilken form har objektet som kolliderer med cyansylinderen?), forklarende (Hva er ansvarlig for den grå sylinderens kollisjon med kuben?), prediktiv (Hvilken hendelse vil skje neste gang?) , og kontrafaktisk (Uten det grå objektet, hvilken hendelse vil ikke skje?). Spørsmålene speiler mange av konseptene som barn lærer tidlig når de utforsker omgivelsene. Men de tre sistnevnte kategoriene, som spesifikt krever kausal resonnement for å svare, stumper ofte dyplæringssystemer.



Mislykket: Datasettet, laget av forskere ved Harvard, DeepMind og MIT-IBM Watson AI Lab, er ment å hjelpe til med å evaluere hvor godt AI-systemer kan resonnere. Når forskerne testet flere state-of-the-art datasyn og naturlige språkmodeller med datasettet, fant de ut at alle gjorde det bra på de beskrivende spørsmålene, men dårlig på de andre.

Blanding av gammelt og nytt: Teamet prøvde deretter et nytt AI-system som kombinerer både dyp læring og symbolsk logikk. Symbolske systemer pleide å være i raseri før de var formørket ved maskinlæring på slutten av 1980-tallet. Men begge tilnærmingene har sine styrker: dyp læring utmerker seg ved skalerbarhet og mønstergjenkjenning; symbolske systemer er bedre på abstraksjon og resonnement.

Det sammensatte systemet, kjent som en nevro-symbolsk modell, utnytter begge deler: det bruker et nevralt nettverk for å gjenkjenne fargene, formene og materialene til objektene og et symbolsk system for å forstå fysikken til deres bevegelser og årsakssammenhengene mellom dem. Den overgikk eksisterende modeller på tvers av alle kategorier av spørsmål.



Hvorfor det er viktig: Som barn lærer vi å observere verden rundt oss, utlede hvorfor ting skjedde og komme med spådommer om hva som vil skje videre. Disse spådommene hjelper oss å ta bedre beslutninger, navigere i miljøene våre og holde oss trygge. Å replikere den slags kausal forståelse i maskiner vil på samme måte utstyre dem til å samhandle med verden på en mer intelligent måte.