Wyszukiwarka akademicka rozumie znaczenie

Jeśli można nauczyć komputery znajdowania znaczenia w tysiącach artykułów naukowych publikowanych każdego roku, to być może mogłyby one automatycznie podkreślać ważne nowe trendy lub odkrycia i wyciągać z nich wnioski.





ten Instytut Allena ds. Sztucznej Inteligencji dąży do tego właśnie celu i opracowała nowe narzędzie o nazwie Uczony semantyczny które mogą przeszukiwać miliony artykułów z dziedziny informatyki. Uruchomione dziś narzędzie umożliwia zawężenie wyszukiwania na podstawie informacji wydobytych z tekstu referatów.

Możliwe jest na przykład zawężenie wyszukiwania według czasopisma, w którym artykuł został opublikowany, lub konferencji, na której została zaprezentowana, albo według użytego zbioru danych. Semantyk pokaże również kluczowe frazy w artykule.

Istnieje już wiele akademickich wyszukiwarek, między innymi Google Scholar , Wyszukiwarka akademicka Microsoft , PubMed , oraz JSTOR . Ale zazwyczaj przeszukują one artykuły tylko przy użyciu słów kluczowych i innych informacji, które są wyraźnie skategoryzowane, takie jak data publikacji.



Oren Etzioni , dyrektor wykonawczy Instytutu Allena, mówi, że wiele istotnych informacji znalezionych w pracach badawczych jest przedstawianych na różne sposoby. Oprogramowanie Semantic Scholar zostało przeszkolone, aby wyodrębnić różne koncepcje przy użyciu różnych technik uczenia maszynowego. Z milionami gazet pojawiających się każdego roku, po prostu nie możesz za nimi nadążyć, mówi Etzioni. Potrzebujesz więc pewnego poziomu zrozumienia.

Rośnie zainteresowanie wykorzystaniem uczenia maszynowego do uczenia komputerów rozpoznawania pewnych pojęć w danych. Google buduje tak zwany wykres wiedzy pojęć, szkoląc algorytmy do indeksowania sieci i wydobywania przydatnych informacji. Dlatego, gdy wyszukujesz Ile lat ma Barack Obama, Google nie tylko wyświetli strony internetowe, które mogą zawierać informacje, ale także poinformuje Cię bezpośrednio, że ma on 54 lata.

Inne firmy próbują zrobić coś podobnego z artykułami akademickimi. Firma o nazwie Meta zapowiedział też dziś usługę, która będzie automatycznie identyfikować osoby i podmioty wymienione w literaturze medycznej. Meta wykorzystuje technologię opracowaną przez SRI w ramach projektu FUSE do prognozowania trendów naukowych przy użyciu uczenia maszynowego.



Dyrektor generalny Meta, Sam Molyneux, mówi, że usługa, która zostanie uruchomiona jeszcze w tym tygodniu, może polecać artykuły użytkownikowi w oparciu o koncepcje zawarte w artykule, który wcześniej przeczytał, a nawet może automatycznie identyfikować pojawiające się technologie. Zasadniczo pozwala to śledzić na poziomie koncepcji lub na poziomie technologii, a nie na poziomie artykułu, mówi Molyneux. Koncepcje takie jak technologia CRISPR, która naprawdę zrewolucjonizowała sposób, w jaki inżynieria genomu ma miejsce teraz – wybraliśmy to jako nową koncepcję kilka lat temu.

Etzioni mówi, że celem Semantic Scholar jest pójście dalej poprzez umożliwienie komputerom znacznie głębszego zrozumienia nowych publikacji naukowych. Jego zespół opracowuje algorytmy, które będą odczytywać wykresy lub wykresy w artykułach i próbować wydobyć z nich przedstawione wartości. Chcemy ostatecznie móc wziąć eksperymentalny artykuł i powiedzieć: „OK, czy muszę go przeczytać, czy komputer może mi powiedzieć, że ten artykuł wykazał, że ten konkretny lek był wysoce skuteczny?”

ukryć