Starszy inżynier ML (fabryka tokenów)
Amsterdam, Netherlands; Berlin, United Kingdom; Prague, Czech Republic; Remote - Europe
Do uzgodnienia
O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
<div class="content-intro"><p><strong>O firmie Nebius:</strong></p> <p>Nebius wyznacza nową erę infrastruktury chmurowej dla globalnej gospodarki opartej na sztucznej inteligencji. Budujemy kompleksową platformę chmurową AI, która wspiera programistów i przedsiębiorstwa od szkolenia w zakresie danych i modeli po wdrożenie produkcyjne, bez kosztów i złożoności budowania dużej wewnętrznej infrastruktury AI/ML.</p> <p>Zbudowana przez inżynierów dla inżynierów. Od orkiestracji procesorów graficznych na dużą skalę po optymalizację wnioskowania - jesteśmy odpowiedzialni za trudne problemy związane z obliczeniami, pamięcią masową, sieciami i stosowaną sztuczną inteligencją.</p> <p>Jesteśmy notowani na giełdzie Nasdaq (NBIS) i z siedzibą w Amsterdamie.
Mamy globalny zasięg z centrami badawczo-rozwojowymi w Europie, Wielkiej Brytanii, Ameryce Północnej i Izraelu. Nasz zespół liczący ponad 1500 osób składa się z setek inżynierów posiadających głęboką wiedzę specjalistyczną w zakresie sprzętu, oprogramowania oraz badań i rozwoju sztucznej inteligencji.</p></div><p><strong>Rola</strong></p> <p>Token Factory jest częścią Nebius Cloud, jednej z największych chmur GPU na świecie, obsługującej dziesiątki tysięcy procesorów graficznych. Budujemy wysokowydajną platformę do wnioskowania i dostrajania, zaprojektowaną w celu wykorzystania podstawowych modeli do granic możliwości sprzętowych.
Naszą misją jest maksymalizacja przepustowości, minimalizowanie opóźnień i optymalizacja kosztu tokena na dziesiątkach tysięcy procesorów graficznych.</p> <p> </p> <p><strong>Kilka kierunków, nad którymi obecnie pracujemy i w których Ty możesz być częścią:</strong></p> <ul> <li>Optymalizacja wnioskowania: identyfikacja wąskich gardeł wnioskowania LLM w celu przyspieszenia produkcji. Wyciskanie maksymalnej wydajności dla szerokiej gamy architektur LLM na dużą skalę (np. GPT-OSS, Kimi K2.5, DeepSeek V3.1/V3.2, GLM-5).</li> <li>Obsługa silników wnioskowania: wdrażaj nowatorskie architektury dekodowania spekulatywnego, optymalizuj komponenty różnych projektów LLM (gęste/MoE, autoregresyjne/równoległe) i przyczyniaj się do wnioskowania typu open source silniki.</li> <li>Uczenie i wnioskowanie o niskiej precyzji: projektuj i twórz potoki uczenia i wnioskowania o niskiej precyzji (FP8, NVFP4/MXFP4), uzyskując mierzalny wzrost przepustowości i efektywności kosztowej.</li> </ul> <p> </p> <p><strong>Oczekujemy, że będziesz mieć:</strong></p> <ul> <li>Dogłębne zrozumienie teoretycznych podstaw uczenia maszynowego i architektury transformatorów.</li> <li>Doświadczenie w profilowaniu obciążeń GPU za pomocą Nsight, profilera PyTorch lub podobnych narzędzi</li> <li>Zrozumienie hierarchii pamięci GPU i kompromisów między mocą obliczeniową a pamięcią</li> <li>Znajomość ważnych koncepcji w przestrzeni LLM, takich jak MHA, RoPE, KV-cache, Flash Attention i kwantyzacja</li> <li> Zrozumienie aspektów wydajnościowych uczenia dużych sieci neuronowych (sharding strategie, niestandardowe jądra, funkcje sprzętowe itp.)</li> <li> Doskonałe umiejętności inżynierii oprogramowania (głównie używamy Pythona)</li> <li>Głębokie doświadczenie z nowoczesnymi frameworkami głębokiego uczenia się</li> <li> Biegłość we współczesnych podejściach do inżynierii oprogramowania, w tym CI/CD, kontrola wersji i testy jednostkowe</li> <li>Dobre zdolności komunikacyjne i przywódcze</li> </ul> <p> </p> <p><strong>Miło to mieć:</strong></p> <ul> <li>Doświadczenie w pracy z silnikami wnioskowania typu open source (vLLM, SGLang, TensorRT-LLM), w tym wkład</li> <li>Doświadczenie z językami jądra lub DSL, takimi jak Triton, Cute, CUTLASS, CUDA</li> <li>Doświadczenie w budowaniu i dostarczaniu produktów (niekoniecznie związanych z ML) w dynamicznym środowisku przypominającym start-up.</li> <li>Doświadczenie z dużymi umiejętnościami inżynieryjnymi, w tym doświadczeniem w tworzeniu dużych systemów rozproszonych lub sieci WWW o dużym obciążeniu usług.</li> <li>Projekty typu open source prezentujące Twoje umiejętności inżynieryjne</li> <li> Doskonała znajomość języka angielskiego w połączeniu z doskonałymi umiejętnościami pisania, artykulacji i komunikacji.</li> </ul> <p> </p> <p> </p><div class="content-conclusion"><p><strong>Korzyści i korzyści:</strong></p> <ul> <li>Konkurencyjne wynagrodzenie</li> <li>Kariera możliwości rozwoju i uczenia się</li> <li>Elastyczność i odpowiedzialność</li> <li>Kultura współpracy i innowacyjności</li> <li>Możliwość pracy nad wpływowymi projektami AI</li> <li>Międzynarodowe środowisko i utalentowane zespoły</li> </ul> <p><strong>Jak to jest pracować w Nebiusie:</strong></p> <p>Szybka zmiana - Odważne myślenie - Ciągły rozwój - Znaczący wpływ - Zaufanie i prawdziwa własność - Możliwość kształtowania przyszłości sztucznej inteligencji </p> <p><strong>Oświadczenie o równych szansach:</strong></p> <p>Nebius jest pracodawcą zapewniającym równe szanse.
Zależy nam na wspieraniu włączającego i zróżnicowanego miejsca pracy oraz zapewnianiu równych możliwości zatrudnienia we wszystkich aspektach zatrudnienia. Nie dyskryminujemy ze względu na rasę, kolor skóry, religię, płeć (w tym ciążę), pochodzenie narodowe, pochodzenie, wiek, niepełnosprawność, informacje genetyczne, stan cywilny, status weterana, orientację seksualną, tożsamość lub ekspresję płciową lub jakąkolwiek inną cechę chronioną przez obowiązujące prawo.</p> <p>Aplikanci muszą mieć zezwolenie na pracę w kraju, w którym składają wniosek, i będą zobowiązani do przedstawienia dokumentu potwierdzającego uprawnienia do zatrudnienia jako warunku zatrudnienia. </p> <p>Jeśli potrzebujesz zakwaterowania w trakcie procesu aplikacyjnego, daj nam znać.</p></div>Znajdź pracę w Niemczech na Arbeitnow
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.