211service.com
Hjernen bag Watson
I februar, game show Fare! stillede sine to mest succesrige deltagere mod et IBM-computersystem kaldet Watson, som besejrede dem solidt. Flere af de strategier, som Watson brugte, var baseret på forskning udført af Boris Katz, en hovedforsker i Computer Science and Artificial Intelligence Laboratory.
I begyndelsen af 1980'erne begyndte Katz at udvikle et naturligt sprog-spørgsmålsbesvarelsessystem kaldet START, som gik online i 1993. Men automatisk besvarelse af spørgsmål gav i sidste ende plads til søgemaskiner som Yahoo og Google, som gav mindre præcise svar, men var meget nemmere at gennemføre.
I 2003 lancerede National Security Agency imidlertid et program til udvikling af et naturligt sprog-spørgsmål-svar-system, som samlede førende forskere på området, herunder Katz og en IBM-gruppe.
Ved midten af dette program var stort set alt, hvad der bruges i Watson, allerede opfundet, siger Katz. Et designprincip, som Watson lånte fra START, var Katz’ forestilling om ternære udtryk. Katz illustrerer ideen med en klausul fra Tom Sawyer : Tom undersøgte to store nåle, som blev stukket ind i reverserne på hans jakke. START repræsenterer de semantiske påstande af klausulen som en serie af treledsrelationer, der hver består af et subjekt, en relation (såsom et verbum eller præposition) og et objekt eller egenskab: Tom undersøgte nålene, Tom har en jakke, jakken har revers, nålene er store, nålene er parret. Mange systemer til behandling af naturligt sprog analyserer sætninger i træer af grammatiske relationer, svarende til sætningsdiagrammer. Men de ternære udtryk, forklarer Katz, er meget nemmere at forstå, opbevare og matche, hvis man vil stille spørgsmål.
IBM-forskerne, siger Katz, brugte adskillige teknikker til informationssøgning, herunder simpel søgeordssøgning samt STARTs parsing og analyse. Men de henrettede dem en størrelsesorden bedre, end alle andre gjorde, siger han. For Katz var det vigtigste aspekt af Watsons design dets evne til at vurdere de relative fordele ved de tusindvis af kandidatsvar, som disse teknikker gav.
Selvom Watson vandt konkurrencen, siger Katz, viser dens lejlighedsvise fejl, at den ikke er i stand til noget som menneskelig erkendelse. Med et spørgsmål i kategorien U.S.Cities, for eksempel, svarede Watson, Toronto. Det er en stor præstation, siger Katz, men det er endnu ikke den hellige gral.