Specjalista AI ds. mowy i dźwięku - ASR | TTS | Głosowa sztuczna inteligencja | Dane dźwiękowe
Remote
Do uzgodnienia
O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
W TELUS Digital rozwijamy przyszłość sztucznej inteligencji, pomagając systemom AI rozumieć, przetwarzać i generować ludzką mowę z większą dokładnością i naturalnością. Jako specjalista AI ds. mowy i dźwięku w naszej społeczności AI będziesz przyczyniać się do rozwoju i udoskonalania technologii sztucznej inteligencji mowy nowej generacji, w tym automatycznego rozpoznawania mowy (ASR), zamiany tekstu na mowę (TTS), sztucznej inteligencji głosowej i systemów uczenia maszynowego audio. Polegamy na naszej globalnej społeczności specjalistów w zakresie oceny, tworzenia, udoskonalania i ulepszania wysokiej jakości zbiorów danych dotyczących mowy i dźwięku.
Twoja wiedza z zakresu produkcji dźwięku, analizy mowy, lingwistyki lub technologii głosowej pomoże zapewnić, że modele AI będą zapewniać naturalne, dokładne, istotne kulturowo i przypominające ludzkie doświadczenia głosowe. W TELUS Digital odegrasz kluczową rolę w kształtowaniu sposobu, w jaki sztuczna inteligencja słucha, rozumie i komunikuje się z ludźmi na całym świecie. Kluczowe obowiązki: - Ocena mowy generowanej przez sztuczną inteligencję (TTS) pod kątem naturalności, dokładności wymowy, rytmu, tonu, emocji i ogólnej jakości głosu. - Przeglądaj i ulepszaj wyniki rozpoznawania mowy (ASR), identyfikując błędy w transkrypcji, problemy z wymową, akcenty i niuanse językowe. - Wykonuj profesjonalne zadania edycji dźwięku, w tym segmentację, przycinanie, redukcję szumów, regulację ciszy i poprawę jakości. - Analizuj nagrania audio za pomocą narzędzi opartych na kształtach fal i spektrogramach w celu identyfikacji problemów z jakością. - Wspieranie tworzenia i walidacji wysokiej jakości zbiorów danych dotyczących mowy wykorzystywanych do szkolenia i oceny modeli sztucznej inteligencji. - Przejrzyj nagrania głosowe pod kątem przejrzystości, spójności, artykulacji i jakości technicznej. - Przeprowadź kontrolę jakości dźwięku, w tym poziomów głośności, wykrywania szumów tła, obcinania, zniekształceń i specyfikacji eksportu. - Wspieraj projekty głosowej sztucznej inteligencji, w tym TTS, ASR, generowanie głosu, podobieństwo głosu, mimikrę głosu i konwersacyjną ocenę AI. - Wykorzystaj wiedzę z zakresu fonetyki, lingwistyki, inżynierii dźwięku lub technologii mowy, aby ulepszyć doświadczenia głosowe generowane przez sztuczną inteligencję. Ścieżka kwalifikacji Obowiązkowe kwalifikacje: Wykształcenie/wykształcenie zawodowe: Co najmniej jedno z poniższych: - Stopień licencjata lub równoważne doświadczenie w zakresie: - Inżynierii dźwięku - Inżynierii dźwięku - Technologii muzycznej - Lingwistyki - Fonetyki - Patologii mowy i języka - Lingwistyki obliczeniowej - Informatyki (koncentrując się na mowie/AI) - Pokrewnych dziedzinach audio lub mowy LUB Doświadczenie zawodowe w następujących obszarach: - Produkcja dźwięku - Projektowanie dźwięku - Montaż dialogów - Nagrywanie głosu - Podcast/audio postprodukcja - Tworzenie danych mowy - Projekty mowy AI Doświadczenie techniczne: Doświadczenie z co najmniej jednym profesjonalnym narzędziem audio: - Adobe Audition - iZotope RX - Pro Tools - Reaper - Audacity - Logic Pro - Cubase - Inne cyfrowe stacje robocze audio (DAW) Znajomość: - Edycji i przywracania dźwięku - Redukcji szumów - Segmentacji mowy - Analizy spektrogramów - Ocena jakości dźwięku - Przepływy pracy związane z przetwarzaniem głosu/audio Wymagania językowe: - Biegłość na poziomie natywnym W przypadku projektów specyficznych dla danego języka preferowany jest poziom (C1/C2+) w wymaganym języku. - Umiejętność rozpoznawania wymowy, akcentu i niuansów językowych. - Znajomość języka angielskiego wystarczająca do zrozumienia instrukcji technicznych i wytycznych projektowych.
Preferowane kwalifikacje: Doświadczenie w zakresie: - automatycznego rozpoznawania mowy (ASR) - zamiany tekstu na mowę (TTS) - sztucznej inteligencji głosowej - zbiorów danych mowy - adnotacji dźwiękowych - projektów klonowania głosu lub naśladowania głosu - ADR/dubbingu - lokalizacji dźwięku - produkcji audycji lub mediów - oceny modelu sztucznej inteligencji Ocena: Aby dołączyć do społeczności TELUS Digital AI Community, kandydaci ukończą: - ocenę kwalifikacji przedmiotowych - praktyczną ocenę dźwięku/mowy (gdzie dotyczy) - Proces weryfikacji tożsamości Ocena może obejmować: - Ocena jakości dźwięku - Przegląd rozpoznawania mowy - Zadania związane z edycją dźwięku - Analizę jakości głosu - Ocena poprawności językowej Płatność: Obecnie stawki dla specjalistów wahają się od 6 do 40 USD za godzinę, w zależności od wiedzy specjalistycznej, złożoności projektu i wymagań rynkowych. *Lokalizacja i język są bezpośrednio zależne. Warunki i stawki płatności ustalane są odrębnie dla każdego zlecenia projektowego. Dlaczego warto dołączyć do społeczności TELUS Digital AI: - Połączenie ze społecznością: Pracuj zdalnie w ramach ponad milionowej zróżnicowanej globalnej społeczności AI składającej się z współpracowników i ekspertów. - Wpływowa wiedza specjalistyczna: wykorzystaj swój język ojczysty i stopień naukowy, aby kształtować rzeczywiste systemy i produkty AI, z których codziennie korzystają miliony. - Praktyczne innowacje: zdobądź doświadczenie w zakresie najnowszych metod badań, oceny i dostrajania sztucznej inteligencji. - Współpraca globalna: współpracuj z siecią specjalistów w ponad 20 domenach i ponad 500 językach i dialektach. - Elastyczne zaangażowanie: zarządzaj własnym harmonogramem, mając jednocześnie znaczący wpływ na przyszłość technologii.
Społeczność cyfrowej sztucznej inteligencji TELUS Nasza globalna społeczność AI to prężna sieć ponad miliona współpracowników z różnych środowisk, którzy pomagają klientom gromadzić, ulepszać, szkolić, tłumaczyć i lokalizować treści w celu tworzenia lepszych modeli sztucznej inteligencji. Zostań częścią naszej rosnącej społeczności i przyczyń się do rozwoju innowacyjnych technologii AI wykorzystywanych przez niektóre z największych światowych marek. Relacja z niezależnym wykonawcą: Ta możliwość jest oferowana na zasadzie niezależnego wykonawcy.
Współautorzy mają swobodę wyboru, kiedy i ile pracują, w zależności od dostępności projektu i wymagań jakościowych. Możliwość ta nie jest i nie powinna być interpretowana jako tworzenie stosunku pracy z TELUS Digital. Aplikuj bezpośrednio na RemoteJobs.org: https://remotejobs.org/remote-jobs/ai-speech-audio-specialist-asr-tts-voice-ai-audio-data-telus-international-ai-inc
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.