Forskere laver hadkort over USA med Twitter-data

Candian-forskere har lavet et hadekort, der sprøjter et amerikansk kort med farvekodning, der viser andelen af ​​alle tweets, der indeholder almindelige hadefulde ord om race, seksuel orientering eller handicap.





Den ansvarlige gruppe, baseret på Californiens Humboldt State University, har tidligere været udsat for en del kritik for deres metodologi i kortlægning af racistiske tweets om præsident Obama ; i det projekt identificerede forskerne racistiske termer algoritmisk, hvilket betyder, at konteksten nogle gange kan blive misforstået. De siger, at de delvist besvarede tidligere kritik ved at analysere tweets i hånden for at sikre, at visse ord virkelig blev brugt på en nedsættende måde. I den nye undersøgelse gennemgik menneskelige læsere 150.000 tweets i undersøgelsesprøven for at bekræfte, at konteksten var nedsættende. Resultaterne er her.

Selvom den nye indsats nøjagtigt kan finde had i tweets, er der grund til at tvivle på, at resultaterne nøjagtigt kortlægger had i USA. For det første er koncentrationen af ​​Twitter-brugere ikke engang på tværs af landet, og ikke alle Tweets er geotaggede (de så kun på de geotaggede). Desuden er mange Twitter-konti markedsføringsbaserede og ville ikke indeholde hadeord, så de ville overdøve signalet. Nogle Twitter-konti er falske. Måske mest af alt kan antallet af gange, en individuel person tweets, variere meget. En fyr, der spyr ud 1.000 hadefulde tweets, vil få sit amt til at se ret dårligt ud.

Overordnet set sætter kortet midtvest og sydøst i et generelt hårdt lys. I modsætning hertil står der, at der ser ud til at være meget lidt had i Californien, Colorado eller Alabama - men meget af det i vrede, røde stænk, såsom et mellem Davenport og Iowa City, Iowa. Min skepsis dæmpes af den ubrudte korridor i lyseblå (betegner noget had) generelt langs New Jersey Turnpike. Når jeg sidder fast der, kan jeg heller ikke lide mine medmennesker.



For at beslutte dig selv, læs mere om metoden her.

skjule