O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
Opis stanowiska Poszukujemy wysoko wykwalifikowanego starszego inżyniera uczenia maszynowego z głęboką wiedzą specjalistyczną w zakresie technologii mowy i dźwięku. Na tym stanowisku będziesz projektować, dostrajać i optymalizować zaawansowane modele uczenia maszynowego dla aplikacji głosowych w języku arabskim. Będziesz pracować przez cały cykl rozwoju, od budowy potoku danych i eksperymentowania z modelami po optymalizację wnioskowania i wdrożenie produkcyjne.
To stanowisko jest idealne dla inżynierów, których pasją jest przekształcanie najnowocześniejszych badań w skalowalne systemy o niskim opóźnieniu, które obsługują naturalne i dokładne interakcje mowy arabskiej. Kluczowe obowiązki - Testowanie porównawcze i ocena modeli TTS i ASR przy użyciu zestawów testowych specyficznych dla języka arabskiego, pomiaru wskaźników, takich jak współczynnik błędów słów (WER), naturalność i pokrycie dialektem. - Dostosuj modele generatywne do klonowania głosu, adaptacji głośników typu zero-shot i syntezy mowy. - Tworzenie i utrzymywanie potoków danych skupionych na języku arabskim, w tym: - Gromadzenie i wstępne przetwarzanie dźwięku - Diakrytyzacja (tashkil) - Czyszczenie i powiększanie danych - Optymalizacja wnioskowania o modelu dla środowisk produkcyjnych przy użyciu: - Kwantyzacji - Dostrajania pamięci podręcznej KV - Technik wnioskowania strumieniowego - Integrowania i oceniania kompletnych potoków konwersacyjnych zamiany mowy na mowę. - Przeprowadzaj eksperymenty w oparciu o najnowsze artykuły badawcze i przekształcaj wnioski w rozwiązania gotowe do produkcji. - Współpraca z zespołami inżynieryjnymi i produktowymi w celu wdrożenia solidnych i skalowalnych systemów mowy. Wymagane kwalifikacje - ponad 5 lat doświadczenia w uczeniu maszynowym, stosowanej sztucznej inteligencji lub badaniach nad sztuczną inteligencją. - Dobra umiejętność programowania w Pythonie. - Rozbudowane, praktyczne doświadczenie z PyTorch i ekosystemem Hugging Face. - Sprawdzone doświadczenie w szkoleniu i dostrajaniu modeli neuronowych w zakresie: - zamiany tekstu na mowę (TTS) - automatycznego rozpoznawania mowy (ASR) - kodeków audio - głębokiego zrozumienia nowoczesnych architektur mowy, takich jak: - szept - konformer - HiFi-GAN - modele oparte na dyfuzji - doświadczenie z technikami przetwarzania dźwięku, w tym: - wykrywanie aktywności głosowej (VAD) - diaryzacja głośników - wokodery neuronowe - wykazana umiejętność wdrażania i dostosowywania badań artykuły dotyczące praktycznych eksperymentów produkcyjnych. - Silne zrozumienie wyzwań związanych z językiem arabskim, w tym: - Diakrytyzacja (tashkil) - Odmiany dialektalne - Przełączanie kodu - Doświadczenie z technikami optymalizacji wnioskowania, takimi jak: - Kwantyzacja - Wnioskowanie strumieniowe - Preferowane kwalifikacje NVIDIA TensorRT - Doświadczenie w tworzeniu niestandardowych jąder NVIDIA CUDA w celu wydajnego wnioskowania o modelach. - Znajomość dekodowania spekulatywnego i innych zaawansowanych technik akceleracji. - Doświadczenie we wdrażaniu modeli na dużą skalę w środowiskach produkcyjnych opartych na chmurze lub procesorach graficznych. - Wkład w projekty mowy lub uczenia maszynowego typu open source.
DLACZEGO NAS POKOCHASZ - Świadczenia dla wszystkich pracowników za darmo (nasz słynny pokój gier, codzienne śniadanie, owoce, kawa i inne gorące napoje, napoje bezalkoholowe i soki, dni firmowe i imprezy...) - Ubezpieczenie społeczne - Polityka zarządzania otwartymi drzwiami - Pełne ubezpieczenie medyczne - Dodatek na zakwaterowanie i transport - Przyjazne środowisko, które ceni innowację i wydajność - Ekscytujące możliwości rozwoju kariery i rozwoju talentów - Informacje zwrotne - Programy uznania i nagród - Konkurencyjne wynagrodzenia i motywacje - Przyjazne środowisko - Elastyczny i wygodny harmonogram - Zabawne komitety - Nagrody pieniężne - Zabawni, inteligentni i kreatywni ludzie - Możliwości kariery w rosnącym zespole - Płatne wakacje - Świadczenia socjalne Aby uzyskać więcej informacji o Nile Bits, odwiedź naszą stronę internetową: Przegląd projektu Dołącz do najnowocześniejszej inicjatywy skupiającej się na budowie zaawansowanej infrastruktury głosowej AI dla rynków arabskojęzycznych. Projekt obejmuje opracowanie najnowocześniejszych technologii mowy w języku arabskim, w tym: - Naturalnego zamiany tekstu na mowę (TTS) - Automatycznego rozpoznawania mowy w czasie rzeczywistym (ASR) - Kompleksowych systemów konwersacyjnych typu Speech-to-Speech Rozwiązania są dostosowane do regionalnych dialektów języka arabskiego, w tym egipskiego, Zatoki Perskiej, Lewantyńskiej i innych. Aplikuj bezpośrednio na RemoteJobs.org: https://remotejobs.org/remote-jobs/senior-applied-ml-engineer-speech-audio-nile-bits
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.