Najlepszy program AI nadal oblewa test naukowy ósmej klasy

Mimo wszystkich niezwykłych postępów w sztucznej inteligencji i ostrzeżeń o wstrząsach, jakie może to przynieść, najmądrzejszy komputer nadal miałby trudności z przetrwaniem ósmej klasy.





Konkurs organizowany przez naukowców z Allen Instytut Sztucznej Inteligencji (AI2) , zaprosili programistów do stworzenia programu zdolnego do podjęcia zmodyfikowanej wersji konwencjonalnego testu z nauk ścisłych ósmej klasy. Wyniki konkursu zostały ogłoszone we wtorek o godz Doroczne spotkanie Stowarzyszenia na rzecz Rozwoju Sztucznej Inteligencji (AAAI).

Zwycięzca, zawodnik mieszkający w Izraelu o nazwisku Chaim Linhart, połączył kilka uznanych technik uczenia maszynowego z dużymi bazami danych informacji naukowych, aby poprawnie odpowiedzieć na 59 procent pytań. Podobnie jak inni uczestnicy, Linhart zadał swojemu systemowi komputerowemu setki tysięcy pytań połączonych z poprawnymi odpowiedziami, aby mógł nauczyć się wymyślać właściwą odpowiedź.

Wynik prawie 60 procent może rozczarować większość rodziców, ale jest niezwykły w przypadku komputera. Test użyty w konkursie został jednak nieco uproszczony, aby był praktyczny dla komputerów. Usunięto na przykład diagramy i użyto tylko pytań z odpowiedziami wielokrotnego wyboru.



Oren Etzioni , naukowiec zajmujący się sztuczną inteligencją, który kieruje sztuczną inteligencją2, twierdzi, że test ósmej klasy miał na celu skłonienie naukowców do opracowania oprogramowania, które nie jest tylko powierzchownie inteligentne.

W ostatnich latach programy przeznaczone do wykonywania określonych zadań, zwłaszcza te, które wymagają pewnego rodzaju przetwarzania wizualnego lub dźwiękowego, szybko się rozwinęły dzięki niezwykle wydajnym algorytmom uczenia maszynowego, zwłaszcza tych opartych na dużych sieciach neuronowych. Imponującym przykładem z ostatnich lat jest program Google zaprojektowany do grania w subtelną i skomplikowaną obliczeniowo grę planszową Go (zobacz AI Masters the Game of Go o dekadę wcześniej niż oczekiwano).

Ten postęp wzbudził nadzieje i obawy, że naprawdę inteligentne maszyny mogą nie być tak daleko. Jednak Etzioni uważa, że ​​potrzebne będą nowe techniki, aby osiągnąć nawet podstawowe kompetencje przy bardziej złożonych zadaniach, co wydają się potwierdzać najnowsze wyniki. Podobnie najlepszy sposób mierzenia postępów w sztucznej inteligencji, test Turinga, okazał się zbyt łatwy do sfałszowania za pomocą prostych sztuczek.



Thomas Dietterich , profesor na Oregon State University i prezes AAAI, mówi, że konkurs AI2 to przydatne ćwiczenie. Dietterich mówi również, że połączenie różnych technik sztucznej inteligencji będzie prawdopodobnie konieczne, aby w przyszłości osiągnąć znacznie wyższy wynik testu. Inteligencja to jedno słowo, ale odnosi się do wielu rzeczy, mówi. Jedną z rzeczy, które lubię w tym, jest to, że podkreśla szerokość w sposób, którego nie mają inne testy.

Gary Marcus, kognitywista z New York University i założyciel startupu AI o nazwie Inteligencja geometryczna , pracuje nad konkursem AI, który będzie miał kilka różnych komponentów. Inteligencja to zmienna wielowymiarowa, mówi Marcus. Nie będzie jednego testu, który byłby boską miarą inteligencji.

Marcus dodaje, że konkurs AI2 w rzeczywistości podkreśla rozmiar wyzwania, przed którym stoją naukowcy zajmujący się sztuczną inteligencją. Za pomocą dość prymitywnych technik można zrobić o wiele więcej niż tylko zgadywanie, ale jednocześnie 60 procent to daleka droga do prawdziwego zrozumienia nauki, dodaje. Najlepszą rzeczą, jaka z tego wynika, jest to, że ludzie mogą zdać sobie sprawę, jak trudne są naprawdę pytania.

ten Konkurs została zorganizowana za pośrednictwem Kaggle, popularnej platformy do koordynowania konkursów, w których analitycy danych walczą o stworzenie najbardziej wydajnego algorytmu do określonego zadania, np. przewidzenia, które produkty będą najlepiej sprzedawać na podstawie wcześniejszej sprzedaży lub wyniku turnieju March Madness. W zeszłym roku AI2 opublikowała ogromny zestaw pytań i odpowiedzi, które umożliwiły uczestnikom zaprojektowanie algorytmów do wykonania testu (patrz AI Software Goes Up Against Fourth Graders on Science Test).

Podczas przemówienia na konferencji AAAI Etzioni zasugerował, że ustalenie trudniejszego testu, w dłuższym okresie czasu, z większą nagrodą, może zainspirować więcej badaczy AI do zaangażowania się. Myślę, że do uzyskania z 60 procent do 80 procent lub więcej potrzebna będzie dłuższa rywalizacja i „głębsza” sztuczna inteligencja — mówi Etzioni. To nasza hipoteza, że ​​nie możesz tego zrobić za pomocą tanich sztuczek – że musisz zrobić coś mądrzejszego.

ukryć