Jak spam poprawia sztuczną inteligencję

Te nieznośne wizualne łamigłówki, które trzeba rozwiązywać za każdym razem, gdy rejestrujesz konto poczty internetowej lub publikujesz komentarz na blogu, są atakowane. Nie chodzi jednak tylko o komputery wyrzucające spam lub hakerów; pochodzi również od badaczy, którzy wykorzystują łamigłówki antyspamowe do opracowywania inteligentniejszych, bardziej ludzkich algorytmów.





Koty kontra psy: Projekt o nazwie Asirra wykorzystuje zdjęcia kotów i psów, aby odróżnić ludzi od komputerów. Zwykle jest to trudne zadanie dla komputerów, ale nowy algorytm może poprawnie klasyfikować obrazy w 83 procentach przypadków.

Najpopularniejszy rodzaj łamigłówek (seria zniekształconych liter i cyfr) jest coraz częściej łamany przez inteligentniejsze oprogramowanie AI. A informatyk opracował teraz algorytm, który może pokonać nawet najnowsze testy fotograficzne.

Znane jako CAPTCHA (Completely Automated Public Turing test, aby powiedzieć Computers and Humans Apart), te łamigłówki zostały opracowane pod koniec lat 90. jako sposób na oddzielenie prawdziwych użytkowników od maszyn, które tworzą konta e-mail w celu wysyłania spamu lub logowania się do wiadomości tablice do zamieszczania linków do reklam. ten Test Turinga , nazwany na cześć matematyka Alana Turinga, polega na pomiarze inteligencji za pomocą komputera, który próbuje podszyć się pod prawdziwą osobę.



Tekstowe CAPTCHA to dobry sposób na odróżnienie ludzi od robotów spamujących, ponieważ zniekształcone litery i cyfry mogą być łatwo odczytane przez prawdziwych ludzi (w większości przypadków), ale są piekielnie trudne do odszyfrowania przez komputery. Jednak informatycy od dawna postrzegają CAPTCHA jako interesujące wyzwanie AI. Projektanci tekstowych CAPTCHA stopniowo wprowadzali więcej zniekształceń, aby uniemożliwić maszynom ich rozwiązywanie. Muszą jednak zrównoważyć bezpieczeństwo z użytecznością: wraz ze wzrostem zniekształceń nawet prawdziwi ludzie zaczynają mieć trudności z rozszyfrowaniem kodów CAPTCHA.

Wcześniej w tym roku, Jeff Yan , naukowiec z University of Newcastle w Wielkiej Brytanii, ujawnił program zdolny do wypełniania tekstowych kodów CAPTCHA używanych do ochrony usług Microsoft Hotmail, MSN i Windows Live z 60-procentowym wskaźnikiem sukcesu. To może nie brzmieć dużo, ale jest to znaczące, ponieważ komputer może próbować ataków tysiące razy na minutę. Yan wstrzymał się z dokumentem, dopóki Microsoft nie miał szansy na zmodyfikowanie swoich CAPTCHA, aby były trudniejsze do złamania. Ale na Konferencja Bezpieczeństwa Komputerowego i Komunikacyjnego ACM w Aleksandrii w stanie Wirginia, jeszcze w tym miesiącu, Yan przedstawi szczegóły innego programu, który, jak twierdzi, może złamać jeszcze szerzej używane tekstowe CAPTCHA.

Więc alternatywą jest poproszenie użytkowników o rozwiązywanie różnego rodzaju łamigłówek. Ale inny artykuł, który zostanie zaprezentowany na tej samej konferencji, opisuje algorytm, który może oznaczać kłopoty dla jeszcze nowszych kodów CAPTCHA.



Filip Golle z Palo Alto Research Center opracował program, który może poprawnie przekazać obrazowy CAPTCHA o nazwie Asirra, opracowany przez Microsoft. Asirra prosi użytkowników o prawidłową klasyfikację zdjęć kotów lub psów, korzystając z bazy danych zawierającej trzy miliony zdjęć dostarczonych przez organizacje zajmujące się ratowaniem zwierząt. To zadanie powinno być nawet trudniejsze dla komputerów niż rozpoznawanie zawiłych liter, ale program Golle'a może poprawnie zidentyfikować koty lub psy pokazywane przez Asirrę w 83 procentach przypadków.

Golle szkolił swój program, korzystając z 8000 obrazów zebranych z tej samej strony internetowej. Dzięki próbom i błędom jego oprogramowanie stopniowo nauczyło się odróżniać koty od psów na podstawie statystycznej analizy koloru i tekstury na każdym zdjęciu. Golle mówi, że różowy język psów i zieleń kocich oczu dostarczają silnych wskazówek, ale tylko poprzez badanie informacji o kolorze i fakturze z tak wielu obrazów, jego program może zaatakować problem. Uczenie maszynowe jest bardzo dobre w agregowaniu informacji, mówi Golle.

Jednak chociaż każde pojedyncze zdjęcie zostało rozpoznane w 83 procentach przypadków, pełny test CAPTCHA wymaga jednoczesnej identyfikacji 12 zdjęć, więc atak faktycznie działa tylko w 10,3 procent przypadków.



Golle mówi, że łatwym środkiem zaradczym dla Asirry byłoby zaprezentowanie większej liczby zdjęć, co jeszcze bardziej obniżyłoby wskaźnik powodzenia ataku. Microsoft nie odpowiedział na nasze prośby o komentarz.

Pomimo tych wszystkich postępów nie jest jasne, czy prawdziwi spamerzy używają obecnie ataków AI przeciwko prawdziwym kodom CAPTCHA. Websense Security Labs w San Diego opublikowało raporty o spamerach łamiących CAPTCHA, ale często wiąże się to po prostu z koniecznością ręcznego rozwiązywania CAPTCHA przez nisko opłacanych pracowników.

Luis von Ahn, informatyk z Carnegie Mellon University, który pomógł ukuć termin CAPTCHA, mówi, że nie jest jasne, czy jakiekolwiek popularne CAPTCHA zostały złamane przez atak maszynowy w prawdziwym świecie. Nie znam nikogo, kto myśli o pozbyciu się CAPTCHA, ponieważ to nie działa, mówi.



Jednak von Ahn zauważa, że ​​wykorzystywanie ludzi ma swoją cenę. Nawet jeśli pracownicy otrzymują tylko 3 dolary za 1000 CAPTCHA, jest to kosztowne, mówi, zwłaszcza, że ​​większość zhakowanych kont poczty internetowej zostanie zamknięta wkrótce po tym, jak zaczną wysyłać spam. Tak więc prawdziwie zautomatyzowany atak zmniejszyłby koszty spamerów i znacznie zwiększyłby liczbę udanych ataków, na które mogliby sobie pozwolić, mówi.

Ale dopóki komputery nie staną się znacznie mądrzejsze, twórcy CAPTCHA zawsze będą mogli zaimplementować kilka prostych poprawek, aby uczynić CAPTCHA znacznie trudniejszym. Myślę, że nadejdzie dzień, kiedy w zasadzie CAPTCHA będą bezużyteczne, mówi von Ahn. Ale nie sądzę, że to będzie w tym roku ani w następnym.

ukryć