211service.com
Hvordan kan vi være sikre på, at AI vil opføre sig? Måske ved at se den diskutere med sig selv.
OpenAI blog
En dag kan det være helt normalt at se et AI-system kæmpe med sig selv.
Konceptet kommer fra forskere ved OpenAI , en nonprofitorganisation grundlagt af flere Silicon Valley-armaturer, herunder Y Combinator-partner Sam Altman, LinkedIn-formand Reid Hoffman, Facebook-bestyrelsesmedlem og Palantir-grundlægger Peter Thiel og Tesla- og SpaceX-chef Elon Musk.
OpenAI-forskerne har tidligere vist, at AI-systemer, der træner sig selv, nogle gange kan udvikle uventede og uønskede vaner. For eksempel kan en agent i et computerspil finde ud af hvordan fejl vej til en højere score. I nogle tilfælde kan det være muligt for en person at overvåge træningsprocessen . Men hvis AI-programmet gør noget umuligt komplekst, er dette muligvis ikke muligt. Så forskerne foreslår at lade to systemer diskutere et bestemt mål i stedet.
Vi tror på, at denne eller en lignende tilgang i sidste ende kan hjælpe os med at træne AI-systemer til at udføre langt mere kognitivt avancerede opgaver, end mennesker er i stand til, mens de forbliver i overensstemmelse med menneskelige præferencer, skriver forskerne i et blogindlæg skitsere konceptet.
Tag for eksempel et AI-system designet til at forsvare sig mod menneskelige eller AI-hackere. For at forhindre systemet i at gøre noget skadeligt eller uetisk, kan det være nødvendigt at udfordre det for at forklare logikken for en bestemt handling. Den logik kan være for kompleks til at en person kan forstå, så forskerne foreslår at få en anden AI til at diskutere handlingens visdom med det første system ved at bruge naturligt sprog, mens personen observerer. Yderligere detaljer fremgår af en forskningsartikel .
At få AI-programmer til at diskutere med hinanden kræver mere sofistikeret teknologi, end der findes i øjeblikket. Indtil videre har OpenAI-forskerne kun udforsket ideen med et par ekstremt enkle eksempler. Det ene involverer to AI-systemer, der forsøger at overbevise en observatør om en skjult karakter ved langsomt at afsløre individuelle pixels.
Forskerne har skabt en hjemmeside hvor alle to personer kan prøve at spille rollerne som de debatterende AI-systemer, mens en tredje tjener som dommer. De to deltagere konkurrerer om at overbevise dommeren om karakteren af et billede, mens de fremhæver dele af det. Til sidst bliver det lettere for iagttageren at fortælle, hvem der er ærlig.
Vincent Conitzer , en forsker ved Duke University, der studerer etiske spørgsmål, der involverer AI, siger, at arbejdet er på et tidligt stadium, men lover. At skabe AI-systemer, der kan forklare deres beslutninger, er en udfordrende forskningsdagsorden, siger han. Hvis det lykkes, kan det i høj grad bidrage til ansvarlig brug af AI.
Som det står – og på trods nogle besynderlig udsagn fra folk som Elon Musk (en OpenAI-finansierer og indtil for nylig medlem af dens bestyrelse) – vi er stadig langt fra at have AI-systemer, der er i stand til at bedrage og overliste os i den type scenarie, der portrætteres i film som f.eks. Eks maskine og Hende .
Alligevel undersøger nogle AI-forskere måder at sikre, at teknologien ikke opfører sig på utilsigtede måder. Dette kan blive vigtigere, efterhånden som AI-programmer bliver mere komplekse og uudgrundelige (se Den mørke hemmelighed i hjertet af AI).
Jeg synes, at ideen om værditilpasning gennem debat er meget interessant og potentielt brugbar, siger Ariel Procaccia , en professor i datalogi ved CMU, der studerer beslutningstagning med autonome systemer.
Procaccia bemærker dog, at værket er meget foreløbigt, og at konceptet endda kan indeholde en grundlæggende selvmodsigelse. For at debattere værdiladede spørgsmål på en måde, der er forståelig for en menneskelig dommer, kan AI-agenterne have brug for et solidt greb om menneskelige værdier i første omgang, siger han. Så fremgangsmåden er velsagtens at sætte vognen før hesten.
Iyad Rawan , en forsker ved MIT's Media lab, tilføjer, at forskerne skulle være forsigtige med, at et par AI'er ikke kom ind i et cirkulært argument. Jeg tror, de vil ramme nogle meget vanskelige problemer meget hurtigt, siger han. Først er, hvordan man automatiserer argumentation i naturligt sprog, hvilket stadig er et uløst problem.