Det semantiske web bliver mainstream

I løbet af en dag håndterer den gennemsnitlige person, der arbejder ved et skrivebord, strømme af information, der kommer fra mange kilder: e-mails, websøgninger, kalendere, noter, regneark, dokumenter og præsentationer. Det er svært at sortere informationerne, og for det meste sker det på en ad hoc måde. Men i de næste par måneder kan der være en bedre måde. Radar netværk , baseret i San Francisco, udgiver et gratis webbaseret værktøj, kaldet Sejlgarn , som den håber vil ændre den måde, folk organiserer deres information på.





Twine er et websted, hvor folk kan dumpe information, der er vigtig for dem, fra rækker af e-mails til YouTube-videoer. Eller, hvis en bruger foretrækker det, kan Twine automatisk indsamle alle de websider, hun har besøgt, e-mails, hun har sendt og modtaget, og så videre. Når Twine har nogle oplysninger, begynder den at analysere den og automatisk sortere den i kategorier, der inkluderer de involverede personer, diskuterede koncepter og steder, organisationer og virksomheder. På denne måde, når en bruger søger efter noget, kan hun få hurtig adgang til relateret information om det. Twine bruger også elementer af sociale netværk, så en bruger har adgang til information indsamlet af andre i hendes netværk. Alt dette skaber en slags kollektiv intelligens, siger Nova Spivack, CEO og grundlægger af Radar Networks.

Spivack siger, at Twine udnytter årtiers arbejde udført inden for esoteriske forskningsfelter såsom maskinlæring og naturlig sprogbehandling. Twine hjælper dig med at blive klogere, mere produktiv og samarbejde, dele og organisere på en smartere måde, siger han.

Idéen bag Twines funktion og teknologier er kendt som Semantic Web, et koncept, der længe har været diskuteret i forskningskredse, og som kan beskrives som en slags smart netværk af information, hvor data er tagget, sorteret og søgbart. Spivack siger, at hans virksomheds værktøj er en af ​​de første mainstream-applikationer af Semantic Web.



For at være sikker er Twine ikke det første Semantic Web-produkt eller -værktøj. I årevis har virksomheder brugt databasesoftware, der automatisk placerer oplysninger i bestemte kategorier og søger efter dem i overensstemmelse hermed, med varierende grad af nøjagtighed. Selv nutidens simple bloggingværktøjer har elementer fra det semantiske web: folk tilføjer tags til deres indlæg og skaber derved nyttige metadata, der kan søges i. Ud over, lækker , den online bogmærkeside, hvor folk tilføjer tags til links på gemte websider, er et eksempel på at give struktur til tidligere ustrukturerede data.

En hård-og-hurtig definition af Semantic Web kan således være uhåndgribelig, siger Clay Shirky , professor i Interactive Telecommunications Program ved New York University. Der er en række, du spiller i, siger han. På det mest basale, siger Shirky, er Semantic Web en kampagne til at tagge information med ekstra metadata, der gør det nemmere at søge. Ved den øvre grænse, siger han, handler det om at vente på, at maskiner bliver ødelæggende intelligente.

Ifølge Spivack kan Twine kaldes en Semantic Web-applikation, fordi softwaren er skrevet med Semantic Web-standarder, etableret af World Wide Web Consortium (W3C), i tankerne. Det betyder, at dets design følger visse konventioner, og på grund af dette er Twine kompatibel med andre semantiske webapplikationer, og dens information kan deles på tværs af applikationer.



Ud over at anvende Semantic Web-standarderne bruger Twine også ekstremt avanceret maskinlæring og behandlingsalgoritmer for naturligt sprog, der giver det funktioner ud over alt, der er afhængigt af manuel tagging. Værktøjet bruger en kombination af naturlige sprogalgoritmer til automatisk at udtrække nøglebegreber fra tekstsamlinger, i det væsentlige automatisk tagge dem. Ifølge Spivack håndterer disse algoritmer behændigt tvetydige sæt af ord og bestemmer for eksempel, om J.P. Morgan er en person eller en virksomhed, afhængigt af konteksten. Og Twine kan finde emnet for en tekst, selvom et nøgleord aldrig bliver nævnt, siger han, ved at bruge statistisk maskinlæring til at sammenligne teksten med datakilder som Wikipedia. Vi kan bestemme, hvornår et dokument handler om et emne, selvom emnet ikke er nævnt i dokumentet, siger Spivack. Så vi kan tilføje nye stier og nye måder at komme til dokumentet under en søgning.

En anden teknik, som Twine bruger, er grafanalyse. Denne idé, forklarer Spivack, ligner tanken bag den sociale graf, som Mark Zuckerberg, grundlæggeren af ​​Facebook, fremhæver: forbindelser mellem mennesker findes i den virkelige verden, og online sociale netværksværktøjer samler simpelthen disse forbindelser og gør dem synlige. På samme måde, siger Spivack, hjælper Twine med at gøre forbindelserne mellem mennesker og deres information mere tilgængelige. Når data er tagget, bliver det i det væsentlige en node i et netværk. Forbindelserne, som hver node har til andre noder (som kan være andre data, personer, steder, organisationer, projekter, begivenheder osv.) afhænger af deres tags og den statistiske relevans, de har for andre noders tags. Sådan bestemmer Twine relevans, når en person søger gennem hans eller hendes oplysninger. Jo længere væk en node er, jo mindre relevant er den for en brugers søgning.

Det er stadig for tidligt at vide, om Twine vil få succes hos forbrugerne, siger Tony Shaw, præsident for Semantic Universe, en organisation, der er forpligtet til at øge bevidstheden om semantiske teknologier i erhvervs- og forbrugermiljøer. Succes afhænger ikke blot af at få teknologien til at fungere, men også af at styre folks forventninger til teknologien, siger han. Det handler om at bekæmpe hypeproblemet.



Twine åbner op for inviterede brugere fra og med i dag. I de næste par måneder, siger Spivack, vil værktøjet acceptere flere brugere, og i sommeren 2008 skulle det være helt åbent. Derudover vil Twine have en åben platform, der giver softwareudviklere mulighed for at bygge værktøjer ovenpå, såsom visualiseringssoftware, så brugerne kan se deres informationer på forskellige måder. Men først starter vi med det grundlæggende, siger Spivack.

skjule