Tak wyglądają kontrowersje w Twittersferze

Wiele kontrowersji szaleje na platformach społecznościowych, takich jak Twitter. Niektóre trwają tygodnie lub miesiące, inne dmuchają po południu. A jednak większość pozostaje niezauważona przez większość ludzi. To by się zmieniło, gdyby istniał niezawodny sposób wykrywania kontrowersji w strumieniu na Twitterze w czasie rzeczywistym.





Mogło to nastąpić dzięki pracy Kirana Garimelli i kumpli z Uniwersytetu Aalto w Finlandii. Ci goście znaleźli sposób na dostrzeżenie cech kontrowersji w zbiorze tweetów i odróżnienie ich od niekontrowersyjnej rozmowy.

Różni badacze badali kontrowersje na Twitterze, ale wszystkie one skupiały się na z góry określonych argumentach, podczas gdy Garimella i spółka chcą je dostrzec w pierwszej kolejności. Ich kluczową ideą jest to, że struktura rozmów, które są kontrowersyjne, różni się od tych, które są łagodne.

Uważają, że tę strukturę można dostrzec, badając różne właściwości konwersacji, takie jak sieć powiązań między osobami zaangażowanymi w dany temat; strukturę adnotacji, kto się z kim zgadza; i sentyment dyskusji, zarówno pozytywny, jak i negatywny.



Sprawdzają ten pomysł, najpierw studiując dziesięć rozmów związanych z hashtagami, o których wiadomo, że są kontrowersyjne i dziesięć, o których wiadomo, że są łagodne. Garimella i współpracownicy opracowują strukturę tych dyskusji, przyglądając się sieci retweetów, obserwacji, słów kluczowych i ich kombinacji.

Sieci te pozwalają na dalsze badania. W szczególności wykresy retweet i follow ujawniają klastry w sieciach, które mogą wskazywać na pewną formę polaryzacji wśród użytkowników. Rzeczywiście, sieci związane z kontrowersyjnymi tematami można wyraźnie podzielić na grupy po obu stronach debaty.

Te obrazy (pokazane powyżej) są pięknymi przedstawieniami kontrowersji, jak fajerwerki na Twitterze. Najbardziej kontrowersyjne są a, b, e i f, które są związane z #beefban, dyskusją o zakazie wołowiny w Indiach, oraz #russia_march, o protestach w Rosji.



Inne są mniej kontrowersyjne: c i g są kojarzone z #sxsw, tagiem festiwalu kreatywności South by South West, a d i h z #germanwings, które dotyczyły rozmów o dramatycznej katastrofie lotniczej w zeszłym roku, ale generalnie nie były kontrowersyjne .

We wszystkich przypadkach obrazy wyraźnie pokazują polaryzację lub jej brak w debacie.

Garimella i współpracownicy opracowali narzędzia do pomiaru rozmiaru tej polaryzacji, a co za tym idzie kontrowersji. Następnie testują te narzędzia na wielu zestawach danych dotyczących prawdy podstawowej, aby zobaczyć, jak dobrze opisują kontrowersje.



Ogólnie rzecz biorąc, ich metody wychwytują kontrowersje lepiej niż istniejące narzędzia, ale w żadnym wypadku nie są doskonałe. Więc dalsza praca jest wyraźnie potrzebna.

Ale kto by pomyślał, że kontrowersyjne tematy mogą wyglądać tak uderzająco? Dzięki takim narzędziom, Garimella i spółka muszą tylko oglądać stream na Twitterze i czekać, aż zaczną się fajerwerki.

Nr ref.: arxiv.org/abs/1507.05224 : Ilościowe określenie kontrowersji w mediach społecznościowych



ukryć