Sådan repareres Microsofts offensive chatbot ved hjælp af tips fra Marvin Minsky og Improv Comedy

Microsofts chatbot Tay blev hurtigt fjernet i sidste uge, efter at den begyndte at tweete stødende udtalelser, der forkyndte homofobi, racisme og antisemitisme, mens den også lavede angreb på specifikke individer.





Alligevel cirkulerer tre noget upassende udtryk stadig i forhold til Tay: AI, læring og smartere.

Vi kan skændes hele dagen om arten af ​​AI og hvor tæt eller langt væk forskellige systemer er på menneskelig ræsonnement, men det er en samtale, der bare ikke er relevant her. Systemet er designet til at inkorporere tekst fra interaktioner med brugere i både personlige svar og tweets. Det er svært at anvende ordet læring på den statistisk drevne proces med optagelse, opskæring og gensamling af rækker af ord, endsige at kalde hele systemet AI.

De åbenlyse rettelser til Tay er allerede blevet foreslået. Udviklerne kunne give systemet en liste over termer, der skal undgås, forhindre det i at lære fra en enkelt bruger, forhindre det i at komme med offentlige ytringer baseret på nyindlært materiale eller endda få et menneske til at moderere, hvad det siger.



Alligevel ville ingen af ​​disse fine tekniske rettelser faktisk løse roden til botens problem: Tay anede simpelthen ikke, hvad den sagde. Rettelserne er alle rettet mod at hjælpe et system, der ikke er så lyst, med at komme igennem en samtale uden at lyde direkte ondt. De er designet til at få Tay til at fremstå smartere uden faktisk at gøre den smartere.

Så hvad ville det betyde at lave Tay synes smartere ved faktisk gør det smartere ?

En tilgang kan ses hos Siri og hendes søstre (de er normalt stemplet som kvinder) som Cortana. Disse systemer genkender nøgleord, der er forbundet med ret snævre opgaver, og afviser programmatiske svar. De har betydelig magt til at handle og generere præcise svar inden for de områder, de forstår. Men Microsoft-teamet bag Tay forsøgte tydeligvis at lave noget mere bredt konversationsorienteret.



I den anden ende af spektret er AI komplet tilgang, hvor systemet aldrig ser dagens lys, før det har adgang til al den viden, der kræves for fuldt ud at forstå alt, hvad der bliver sagt til det, alt hvad disse ytringer indebærer, og fulde implikationer af sine egne udtalelser igen.

Software, der opfylder disse kriterier, ville kræve en rig og komplet repræsentation af verden, et massivt bibliotek af slutningsregler, der kører hver gang en ny kendsgerning kommer til syne, og evnen til at generere sprog baseret på enhver idé og kombination af ideer, den støder på eller finder ud af det selvstændigt. Det er et risikabelt 20-årigt forskningsprojekt snarere end en produktkøreplan.

Der er dog en mellemvej mellem bare at skære og skære sætninger i terninger og forsøge at lave noget, der kan forstå hele skabelsen. Det indebærer at give systemet bare en lille smule viden - nok til at genkende, når en bruger forsøger at spille systemet. Du behøver ikke vide alt. Du skal bare vide, når nogen roder med dig.



I betragtning af at Microsofts release notes for Tay sagde, at holdet inkluderede improvisationskomikere, jeg er overrasket over, at dette ikke var vejen.

Jeg personligt har modtaget nok forslag fra publikum til at vide, at ved hver polterabend vil en beruset ung kvinde i ryggen råbe uanstændige forslag, som hun vil fortryde i de næste to år. Når det sker, har du to valg: enten respektere forslaget og arbejde det ind i en scene uden at gøre det forstyrrende, eller høfligt sige Det første, jeg hørte forfra, var 'postkasse' og gå videre. Det vigtige er at være i stand til at vide, hvornår det sker, og have en handlingsplan for at håndtere det.

Intet neutraliserer en mobber så godt som at blive kaldt ud. Mit gæt er, at hvis Tay påpegede, at den vidste, at den blev spillet i en-til-en-interaktioner og gav tilskrivning for nyligt lærte fakta, når de brugte dem i offentlige tweets, ville shaming-effekten have været nok til at lukke ned for selv de grimmeste angreb .



Store samtalepartnere ved ikke alt. De kender samtalen. Og et system, der ikke kender noget til verden, men som ved, hvordan man interagerer og ikke fornærmer, ville være genialt. Men for at reagere på spillet, skal du erkende, hvornår det bliver spillet.

Den afdøde Marvin Minsky udtalte: En lille smule semantik rækker langt. Systemer som Tay behøver ikke at vide alt om verden, men de har brug for at vide, hvad de laver, og hvad brugerne vil gøre ved dem. Den afgørende lille smule, Tay manglede, var evnen til at vide, hvornår den blev spillet, og evnen til at svare i naturalier.

Jeg håber, at Tay snart kommer online igen. Endnu mere håber jeg, at den laver en Reddit AMA, hvor den forklarer kilden til hver og en af ​​dens tweets og de erfaringer, den har lært af at blive mobbet i skolegården, som er internettet.

Kristian Hammond er professor i datalogi ved Northwestern University og chefforsker og medstifter af Narrativ Videnskab , som tilbyder software, der automatisk genererer skriftlige rapporter fra data . Af grunde, som ingen helt forstår, har han brugt omkring 20 år på scenen på at lave improvisationer med folk, der er langt mere talentfulde, end han er.

skjule