211service.com
Nowe standardy badań klinicznych nad sztuczną inteligencją pomogą wykryć olej z węża i szum szumu
Kyle McDonald / Flickr
Wiadomości: Międzynarodowe konsorcjum ekspertów medycznych wprowadziło pierwsze oficjalne standardy badań klinicznych, w których wykorzystuje się sztuczną inteligencję. Ruch ten pojawia się w momencie, gdy szum wokół medycznej sztucznej inteligencji jest na szczycie, z zawyżonymi i niezweryfikowanymi twierdzeniami o skuteczności niektórych narzędzi, które zagrażają ogólnie podważeniem zaufania ludzi do sztucznej inteligencji.
Co to znaczy: ogłoszony w Medycyna natury , British Medical Journal i Lancet, nowe standardy rozszerzają dwa zestawy wytycznych dotyczących prowadzenia i raportowania badań klinicznych, które są już wykorzystywane na całym świecie do opracowywania leków, testów diagnostycznych i innych interwencji medycznych. Badacze AI będą teraz musieli opisać umiejętności potrzebne do korzystania z narzędzia AI, otoczenie, w którym AI jest oceniana, szczegóły dotyczące jak ludzie wchodzą w interakcję z AI , analiza przypadków błędów i nie tylko.
Dlaczego jest to ważne: Kontrolowane badania z randomizacją są najbardziej godnym zaufania sposobem wykazania skuteczności i bezpieczeństwa leczenia lub techniki klinicznej. Stanowią podstawę zarówno praktyki lekarskiej, jak i polityki zdrowotnej. Jednak ich wiarygodność zależy od tego, czy badacze przestrzegają ścisłych wytycznych w zakresie przeprowadzania i raportowania ich badań. W ciągu ostatnich kilku lat opracowano i opisano w czasopismach medycznych wiele nowych narzędzi sztucznej inteligencji, ale ich skuteczność jest trudna do porównania i oceny ze względu na różną jakość projektów badań. W marcu, badanie w BMJ ostrzegł, że słabe badania i przesadzone twierdzenia o tym, jak dobra sztuczna inteligencja radzi sobie z analizą obrazów medycznych, stanowią zagrożenie dla milionów pacjentów.
Szczytowy szum: Brak wspólnych standardów pozwolił również prywatnym firmom krzyczeć na temat skuteczności ich sztucznej inteligencji bez konieczności konfrontacji z innymi rodzajami interwencji medycznych lub diagnoz. Na przykład brytyjska firma cyfrowa zajmująca się zdrowiem Zdrowie Babilonu znalazł się pod ostrzałem w 2018 r. za ogłoszenie, że jego chatbot diagnostyczny jest na równi z ludzkimi lekarzami, na podstawie testu argumentowany przez krytyków był mylący.
Babylon Health nie jest osamotniony. Deweloperzy twierdzą, że medyczna sztuczna inteligencja od jakiegoś czasu przewyższa lub dorównuje ludzkim zdolnościom, a pandemia spowodowała wzrost tego trendu, ponieważ firmy konkurują o to, by ich narzędzia zostały zauważone. W większości przypadków ocena tych AI odbywa się na miejscu iw sprzyjających warunkach.
Obietnica na przyszłość: Nie oznacza to, że sztuczna inteligencja nie może pokonać ludzkich lekarzy. W rzeczywistości pierwsza niezależna ocena narzędzia diagnostycznego AI, które przewyższała ludzi w wykrywaniu raka na mammogramach, była opublikowano tylko w zeszłym miesiącu . Badanie wykazało, że narzędzie stworzone przez Lunit AI i używane w niektórych szpitalach w Korei Południowej znalazło się w środku grupy radiologów, z którymi było testowane. Było to jeszcze dokładniejsze w połączeniu z ludzkim lekarzem. Oddzielając dobro od zła, nowe standardy ułatwią tego rodzaju niezależną ocenę, ostatecznie prowadząc do lepszej i bardziej godnej zaufania sztucznej inteligencji medycznej.