Sieć semantyczna wkracza do głównego nurtu

W ciągu dnia przeciętny człowiek pracujący przy biurku ma do czynienia z potokami informacji pochodzących z wielu źródeł: wiadomości e-mail, wyszukiwań internetowych, kalendarzy, notatek, arkuszy kalkulacyjnych, dokumentów i prezentacji. Sortowanie informacji jest trudne i w większości odbywa się to w sposób doraźny. Ale w ciągu najbliższych kilku miesięcy może być lepszy sposób. Sieci radarowe , z siedzibą w San Francisco, udostępnia bezpłatne narzędzie internetowe o nazwie Szpagat , że ma nadzieję zmienić sposób, w jaki ludzie organizują swoje informacje.





Twine to strona internetowa, na której ludzie mogą zrzucać ważne dla siebie informacje, od ciągów e-maili po filmy na YouTube. Lub, jeśli użytkownik woli, Twine może automatycznie zbierać wszystkie odwiedzane przez nią strony internetowe, wysłane i odebrane wiadomości e-mail i tak dalej. Gdy Twine ma już pewne informacje, zaczyna je analizować i automatycznie sortować na kategorie, które obejmują zaangażowane osoby, omawiane koncepcje oraz miejsca, organizacje i firmy. W ten sposób, gdy użytkownik czegoś szuka, może mieć szybki dostęp do powiązanych informacji na jego temat. Twine wykorzystuje również elementy sieci społecznościowych, dzięki czemu użytkownik ma dostęp do informacji gromadzonych przez inne osoby w jej sieci. Wszystko to tworzy rodzaj zbiorowej inteligencji, mówi Nova Spivack, dyrektor generalny i założyciel Radar Networks.

Spivack mówi, że Twine wykorzystuje dziesiątki lat pracy wykonanej w ezoterycznych dziedzinach badawczych, takich jak uczenie maszynowe i przetwarzanie języka naturalnego. Twine pomaga stać się mądrzejszym, bardziej produktywnym oraz współpracować, udostępniać i organizować w inteligentniejszy sposób, mówi.

Idea leżąca u podstaw funkcji i technologii Twine jest znana jako Sieć Semantyczna, koncepcja od dawna dyskutowana w kręgach naukowych, którą można opisać jako rodzaj inteligentnej sieci informacji, w której dane są oznaczane, sortowane i przeszukiwane. Spivack mówi, że narzędzie jego firmy jest jedną z pierwszych głównych aplikacji sieci semantycznej.



Oczywiście, Twine nie jest pierwszym produktem ani narzędziem sieci semantycznej. Od lat firmy korzystają z oprogramowania bazodanowego, które automatycznie umieszcza informacje w określonych kategoriach i odpowiednio je wyszukuje, z różnym stopniem dokładności. Nawet dzisiejsze proste narzędzia do blogowania zawierają elementy sieci semantycznej: ludzie dodają tagi do swoich postów, tworząc w ten sposób przydatne metadane, które można przeszukiwać. Dodatkowo, pyszne , witryna z zakładkami online, w której użytkownicy dodają znaczniki do łączy zapisanych stron internetowych, jest przykładem strukturyzowania danych, które wcześniej nie miały struktury.

Tak więc twarda i szybka definicja sieci semantycznej może być nieuchwytna, mówi: Glina Shirky , profesor w Interaktywnym Programie Telekomunikacji na Uniwersytecie Nowojorskim. Jest zakres, w którym grasz, mówi. Mówi Shirky, że w najprostszym przypadku sieć semantyczna jest kampanią mającą na celu oznaczanie informacji dodatkowymi metadanymi, które ułatwiają wyszukiwanie. Mówi, że na górnej granicy chodzi o czekanie, aż maszyny staną się dewastująco inteligentne.

Według Spivack, Twine można nazwać aplikacją sieci semantycznej, ponieważ oprogramowanie zostało napisane zgodnie ze standardami sieci semantycznej, ustanowionymi przez konsorcjum World Wide Web Consortium (W3C). Oznacza to, że jego projekt jest zgodny z pewnymi konwencjami i dlatego Twine jest kompatybilny z innymi aplikacjami sieci semantycznej, a zawarte w nim informacje mogą być udostępniane między aplikacjami.



Oprócz stosowania standardów sieci semantycznej, Twine wykorzystuje również niezwykle zaawansowane algorytmy uczenia maszynowego i przetwarzania języka naturalnego, które dają mu możliwości wykraczające poza wszystko, co polega na ręcznym tagowaniu. Narzędzie wykorzystuje kombinację algorytmów języka naturalnego, aby automatycznie wyodrębniać kluczowe pojęcia ze zbiorów tekstu, zasadniczo automatycznie je oznaczając. Według Spivacka algorytmy te zręcznie radzą sobie z niejednoznacznymi zestawami słów, określając na przykład, czy J.P. Morgan jest osobą, czy firmą, w zależności od kontekstu. A Twine może znaleźć temat tekstu, nawet jeśli słowo kluczowe nigdy nie jest wymienione, mówi, używając statystycznego uczenia maszynowego do porównania tekstu ze źródłami danych, takimi jak Wikipedia. Możemy określić, kiedy dokument dotyczy tematu, nawet jeśli temat nie jest wymieniony w dokumencie, mówi Spivack. Możemy więc dodawać nowe ścieżki i nowe sposoby dotarcia do dokumentu podczas wyszukiwania.

Inną techniką używaną przez Twine jest analiza grafów. Ten pomysł, wyjaśnia Spivack, jest podobny do myślenia stojącego za wykresem społecznościowym, który wychwala Mark Zuckerberg, założyciel Facebooka: połączenia między ludźmi istnieją w prawdziwym świecie, a internetowe narzędzia społecznościowe po prostu zbierają te połączenia i uwidaczniają. W ten sam sposób, mówi Spivack, Twine pomaga uczynić połączenia między ludźmi i ich informacjami bardziej dostępnymi. Kiedy dane są oznakowane, stają się w zasadzie węzłem w sieci. Połączenia, które każdy węzeł ma z innymi węzłami (które mogą być innymi danymi, ludźmi, miejscami, organizacjami, projektami, wydarzeniami itp.) zależą od ich tagów i znaczenia statystycznego, jakie mają dla tagów innych węzłów. W ten sposób Twine określa trafność, gdy dana osoba przeszukuje swoje informacje. Im dalej znajduje się węzeł, tym mniej ma on znaczenie dla wyszukiwania użytkownika.

Tony Shaw, prezes Semantic Universe, organizacji zaangażowanej w podnoszenie świadomości na temat technologii semantycznych w środowisku biznesowym i konsumenckim, mówi, że wciąż jest za wcześnie, aby wiedzieć, czy Twine odniesie sukces wśród konsumentów. „Sukces nie będzie po prostu zależał od tego, czy technologia będzie działać, ale także od zarządzania oczekiwaniami ludzi wobec technologii” – mówi. Chodzi o walkę z problemem szumu.



Od dzisiaj Twine otworzy się dla zaproszonych użytkowników. W ciągu najbliższych kilku miesięcy, mówi Spivack, narzędzie zaakceptuje więcej użytkowników, a latem 2008 roku powinno być całkowicie otwarte. Ponadto Twine będzie miał otwartą platformę, która umożliwi programistom tworzenie na jej podstawie narzędzi, takich jak oprogramowanie do wizualizacji, dzięki czemu użytkownicy będą mogli zobaczyć swoje informacje na różne sposoby. Ale najpierw zaczynamy od podstaw, mówi Spivack.

ukryć