Jak możemy być pewni, że AI będzie się zachowywać? Być może obserwując, jak kłóci się ze sobą.

Blog OpenAI





Pewnego dnia oglądanie walki systemu AI z samym sobą może być zupełnie normalne.

Koncepcja pochodzi od naukowców z Otwórz AI , organizacja non-profit założona przez kilku luminarzy Doliny Krzemowej, w tym partnera Y Combinator Sama Altmana, prezesa LinkedIn Reida Hoffmana, członka zarządu Facebooka i założyciela Palantir Petera Thiela oraz szefa Tesli i SpaceX Elona Muska.

Badacze OpenAI wykazali wcześniej, że systemy AI, które same się szkolą, mogą czasami wykształcić nieoczekiwane i niechciane nawyki. Na przykład w grze komputerowej agent może wymyślić, jak: usterka drogę do wyższego wyniku. W niektórych przypadkach może być możliwe, że dana osoba: nadzorować proces szkolenia . Ale jeśli program AI robi coś niemożliwie skomplikowanego, może to być niewykonalne. Dlatego naukowcy sugerują, aby zamiast tego dwa systemy omawiały konkretny cel.



Uważamy, że to lub podobne podejście może ostatecznie pomóc nam wytrenować systemy sztucznej inteligencji do wykonywania znacznie bardziej zaawansowanych poznawczo zadań niż ludzie są w stanie, pozostając w zgodzie z ludzkimi preferencjami, piszą naukowcy wpis na blogu zarys koncepcji.

Weźmy na przykład system AI przeznaczony do obrony przed hakerami ludzkimi lub AI. Aby uniemożliwić systemowi robienie czegokolwiek szkodliwego lub nieetycznego, konieczne może być zakwestionowanie go w celu wyjaśnienia logiki konkretnego działania. Ta logika może być zbyt złożona, aby dana osoba mogła zrozumieć, więc naukowcy sugerują, aby inna sztuczna inteligencja debatowała nad zasadnością działania z pierwszym systemem, używając języka naturalnego, podczas gdy osoba obserwuje. Dalsze szczegóły pojawiają się w artykuł naukowy .

Aby programy AI kłóciły się ze sobą, wymagają bardziej zaawansowanej technologii niż obecnie. Do tej pory badacze OpenAI badali ten pomysł tylko na kilku niezwykle prostych przykładach. Jeden obejmuje dwa systemy sztucznej inteligencji, które próbują przekonać obserwatora o ukrytej postaci, powoli odsłaniając poszczególne piksele.



Naukowcy stworzyli Strona internetowa gdzie dowolne dwie osoby mogą spróbować odgrywać role debatujących systemów sztucznej inteligencji, podczas gdy trzecia służy jako sędzia. Dwóch uczestników rywalizuje, aby przekonać sędziego o charakterze obrazu, jednocześnie podkreślając jego fragmenty. W końcu obserwatorowi łatwiej jest stwierdzić, kto jest uczciwy.

Vincent Conitzer , naukowiec z Duke University, który bada kwestie etyczne związane ze sztuczną inteligencją, twierdzi, że prace są na wczesnym etapie, ale są obiecujące. – Tworzenie systemów AI, które mogą wyjaśniać ich decyzje, jest trudnym programem badawczym – mówi. Jeśli się powiedzie, może znacznie przyczynić się do odpowiedzialnego wykorzystania sztucznej inteligencji.

W obecnym stanie — i pomimo niektóre obcy sprawozdania od takich jak Elon Musk (fundator OpenAI i do niedawna członek jego zarządu) – wciąż jesteśmy dalecy od posiadania systemów AI zdolnych nas oszukać i przechytrzyć w scenariuszu przedstawianym w filmach takich jak Była maszyna oraz Jej .

Mimo to niektórzy badacze sztucznej inteligencji badają sposoby zapewnienia, aby technologia nie zachowywała się w niezamierzony sposób. Może to stać się ważniejsze, ponieważ programy AI stają się bardziej złożone i nieprzeniknione (patrz Mroczny sekret w sercu AI ).

Myślę, że idea wyrównywania wartości poprzez debatę jest bardzo interesująca i potencjalnie przydatna, mówi Ariel Procaccia , profesor informatyki na CMU, który bada podejmowanie decyzji za pomocą systemów autonomicznych.

Jednak Procaccia zauważa, że ​​praca jest bardzo wstępna i że koncepcja może nawet zawierać fundamentalną sprzeczność. Mówi, że aby przedyskutować kwestie obciążone wartościami w sposób zrozumiały dla ludzkiego sędziego, agenci AI mogą potrzebować przede wszystkim solidnego zrozumienia ludzkich wartości. Tak więc podejście polega prawdopodobnie na postawieniu wozu przed koniem.

Iyad Rawan , naukowiec z laboratorium mediów MIT, dodaje, że badacze musieliby uważać, aby para AI nie wdała się w okrągłą kłótnię. Myślę, że bardzo szybko trafią w bardzo trudne problemy, mówi. Po pierwsze, jak zautomatyzować argumentację w języku naturalnym, co jest wciąż nierozwiązanym problemem.

ukryć