211service.com
Jak świecenie laserem na twojej twarzy może pomóc Siri cię zrozumieć
Od Siri, przez Alexę po Cortanę, rozmawiamy z wirtualnymi asystentami częściej niż kiedykolwiek wcześniej. Nadal jednak mogą mieć problemy ze zrozumieniem prostych poleceń odtwarzania muzyki lub wyszukiwania wskazówek, zwłaszcza w hałaśliwych miejscach.
Zamiast skupiać się na czyszczeniu sygnału audio, który wychwytuje Twój głos, izraelski startup Powiększenie wokalu uważa, że można znacznie usprawnić działanie wszelkiego rodzaju aplikacji do rozpoznawania mowy, używając maleńkiego lasera o małej mocy, który mierzy drobne wibracje skóry podczas mówienia.
Firma, która do tej pory zebrała około 12,5 miliona dolarów w funduszach venture, buduje czujnik z małym laserem, który, jak mówi, będzie początkowo wbudowany w zestawy słuchawkowe i kaski; tam będzie używany wraz z istniejącymi technologiami rozpoznawania mowy, które opierają się na mikrofonach w celu zmniejszenia ogólnych nieporozumień.
Założyciel i dyrektor generalny VocalZoom, Tal Bakish, uważa, że najpierw będzie on używany do takich rzeczy, jak kaski motocyklowe lub zestawy słuchawkowe noszone przez pracowników magazynu – możesz go użyć na przykład do pytania o drogę podczas jazdy Harleyem. Chińska firma zajmująca się rozpoznawaniem mowy o nazwie iFlytek planuje przygotować prototypowy zestaw słuchawkowy pod koniec sierpnia. Bakish spodziewa się również, że zostanie on dodany do samochodów do 2018 r. w celu wydawania poleceń głosowych, gdy siedzisz za kierownicą. Firma ma umowy o wspólnym rozwoju z kilkoma firmami motoryzacyjnymi, choć nie wymieni ich w rejestrze, a także jest zainteresowany wprowadzeniem tej technologii do smartfonów.
W hałaśliwej kawiarni w Bostonie Bakish pokazuje mi niedziałającą wersję pierwszego produktu VocalZoom, który ma być gotowy tego lata: malutki czujnik z laserem, który świeci bezpośrednio na twarz (mówi, że jest bezpieczny dla oczu według amerykańskiej żywności i przepisy Administracji Leków). Gdybyś na przykład używał jednego z tych czujników w zestawie słuchawkowym, aby zapytać o drogę do restauracji, zmierzyłby on prędkość wibracji skóry twarzy, podczas gdy zwykły sygnał dźwiękowy zostałby przechwycony przez mikrofon; oprogramowanie porównuje te dwa sygnały, aby uzyskać najlepsze przybliżenie tego, co próbujesz powiedzieć.
Bakish mówi, że czujnik VocalZoom może mierzyć wibracje skóry od oczu do gardła i szyi, a także od tyłu, na przykład poprzez analizę wibracji za uszami. Laser może działać w odległości do jednego metra, chociaż w przypadku zestawu słuchawkowego wystarczająca jest odległość pięciu centymetrów.
Bakish mówi, że w połączeniu z bardziej standardową technologią rozpoznawania mowy, VocalZoom był w stanie obniżyć współczynniki błędów rozpoznawania mowy o 60 do 80 procent.
Abe Davis , doktorant w Laboratorium Informatyki i Sztucznej Inteligencji MIT, którego praca koncentrowała się na zbieranie dźwięku z wideo poprzez analizę drobnych wibracji wytwarzanych przez różne obiekty , uważa, że trudno byłoby zmusić VocalZoom do pracy w samochodzie, gdzie podejrzewa, że może to być utrudnione przez takie rzeczy, jak poruszanie się głową.
Jednak w zestawie słuchawkowym lub kasku widział, że jest to przydatne.
To tylko kwestia tego, czy możesz upewnić się, że laser jest skierowany na właściwą rzecz, mówi.