Hvordan rollespil en drage kan lære en AI at manipulere og overtale

Facebook





En AI, der fuldfører quests i et tekstbaseret eventyrspil ved at tale med karaktererne, har lært ikke kun, hvordan man gør tingene, men hvordan man får andre at gøre ting. Det system er et skridt mod maskiner, der kan bruge sproget som en måde at nå deres mål.

Meningsløs prosa: Sprogmodeller som GPT-3 er geniale til at efterligne menneskeskrevne sætninger, udsende historier, falske blogs og Reddit-indlæg . Men der er ikke megen mening med dette produktive output ud over selve produktionen af ​​teksten. Når mennesker bruger sproget, bliver det brugt som et værktøj: vores ord overbeviser, kommanderer og manipulerer; de får folk til at grine og får folk til at græde.

Blander tingene sammen: For at bygge en AI, der brugte ord af en grund, kombinerede forskere fra Georgia Institute of Technology i Atlanta og Facebook AI Research teknikker fra naturligt sprogbehandling og forstærkningslæring, hvor maskinlæringsmodeller lærer, hvordan man opfører sig for at nå givne mål. Begge disse marker har oplevet enorme fremskridt i de sidste par år, men der har været ringe krydsbestøvning mellem de to.



Ordspil: For at teste deres tilgang trænede forskerne deres system i et tekstbaseret multiplayer-spil kaldet LYS , udviklet af Facebook sidste år for at studere kommunikation mellem mennesker og AI-spillere. Spillet foregår i en verden med fantasitemaer fyldt med tusindvis af crowdsourcede objekter, karakterer og lokationer, der beskrives og interageres med via tekst på skærmen. Spillere (menneske eller computer) handler ved at skrive kommandoer såsom kramme-guiden, slå drage eller fjerne hatten. De kan også tale med de chatbot-kontrollerede karakterer.

Dragon quest: For at give deres AI-grunde til at gøre ting tilføjede forskerne omkring 7.500 crowdsourcede quests, som ikke er inkluderet i den originale version af LIGHT. Endelig skabte de også en vidensgraf (en database med subjekt-verb-objekt-forhold), der gav AI'en sund fornuft information om spillets verden og forbindelserne mellem dets karakterer, såsom princippet om, at en købmand kun vil stole på en vagt, hvis de er venner. Spillet havde nu handlinger (såsom Gå til bjergene og Spis ridderen) at udføre for at fuldføre quests (såsom Byg den største skattekiste, der nogensinde er opnået af en drage).

Sød taler: Ved at trække alt dette sammen, trænede de AI til at fuldføre quests blot ved at bruge sprog. For at udføre handlinger kan den enten skrive kommandoen for den pågældende handling eller opnå samme mål ved at tale med andre karakterer. For eksempel, hvis AI'en havde brug for et sværd, kunne den vælge at stjæle et eller overbevise en anden karakter om at aflevere et.



Indtil videre er systemet et legetøj. Og dens måde at være sløv på: På et tidspunkt, der har brug for en spand, siger den simpelthen: Giv mig den spand, eller jeg giver dig til min kat! Men at blande NLP med forstærkende læring er et spændende skridt, der ikke kun kan føre til bedre chatbots, der kan argumentere og overbevise, men også dem, der har en meget rigere forståelse af, hvordan vores sprogfyldte verden fungerer.

skjule