O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
O Nebiusie: Nebius wyznacza nową erę w infrastrukturze chmurowej dla globalnej gospodarki opartej na sztucznej inteligencji. Budujemy kompleksową platformę chmurową AI, która wspiera programistów i przedsiębiorstwa od szkolenia danych i modeli po wdrożenie produkcyjne, bez kosztów i złożoności budowania dużej wewnętrznej infrastruktury AI/ML. Zbudowany przez inżynierów dla inżynierów.
Od orkiestracji procesorów graficznych na dużą skalę po optymalizację wnioskowania - jesteśmy odpowiedzialni za trudne problemy związane z obliczeniami, pamięcią masową, siecią i zastosowaną sztuczną inteligencją. Jesteśmy notowani na giełdzie Nasdaq (NBIS) z siedzibą w Amsterdamie. Mamy globalny zasięg z ośrodkami badawczo-rozwojowymi w Europie, Wielkiej Brytanii, Ameryce Północnej i Izraelu.
Nasz zespół liczący ponad 1500 osób składa się z setek inżynierów posiadających głęboką wiedzę specjalistyczną w zakresie sprzętu, oprogramowania oraz badań i rozwoju sztucznej inteligencji. Stanowisko to znajduje się w Nebius Token Factory, naszej bezserwerowej platformie do uruchamiania i dostosowywania rozwiązań LLM typu open source w środowisku produkcyjnym. Token Factory umożliwia wnioskowanie i dostrajanie bez serwera, wspierane przez wewnętrzne optymalizacje, takie jak niestandardowe dekodowanie spekulatywne, kwantyzacja, routing uwzględniający pamięć podręczną i dedykowane punkty końcowe.
Klienci przychodzą do nas, aby przejść od prototypu do skalowanej produkcji bez kosztów i złożoności budowania i dostrajania własnego stosu wnioskowania. Nasi architekci rozwiązań odpowiadają za techniczną realizację zobowiązań klientów: wdrażanie modeli typu open source, dostrajanie stosu obsługi, porównywanie z kryteriami sukcesu klienta i przenoszenie relacji technicznej do produkcji. Inżynierowie sprzedaży kwalifikują i określają zakres możliwości; SA to wykonują.
Menedżerowie ds. klientów technicznych przejmą tę działalność już od etapu produkcyjnego. Poszukujemy menedżera ds. architektury rozwiązań ML, który będzie kierował naszymi regionalnymi zespołami SA w UE. Twoim zakresem jest dostawa PoC i wsparcie techniczne posprzedażne: ludzie, którzy to robią, standard, zgodnie z którym to robią, oraz rytm działania, który zapewnia przewidywalność.
Będziesz raportować do kierownika ds. architektury rozwiązań i współpracować z menedżerem równorzędnym w innym regionie. Oczekujemy, że będziesz popychać ludzi, gdy tego potrzebują, wykonywać niewygodne telefony, gdy rezultaty nie dochodzą do skutku, mimo że wysiłek był rzeczywisty, oraz przejąć odpowiedzialność za prace nad dokumentacją: wdrażanie i monitorowanie następujących wytycznych, higiena zgłoszeń i upewnianie się, że zespół faktycznie korzysta ze wszystkich trzech. Możesz pracować zdalnie z dowolnego kraju UE.
Twoje obowiązki będą obejmować: Kierowanie zespołem Zarządzanie zespołem 8 architektów rozwiązań, ciągła współpraca planowany rozwój: 1:1, wyznaczanie celów, przeglądy wyników, przypadki awansów i indywidualne plany rozwoju Stwórz dokładny obraz mocnych stron, luk i preferencji każdego SA, a także przydzielaj konta i zadania zgodnie zarówno z wiedzą, jak i zainteresowaniami. Ustal rytm, który wcześnie wykryje przeszkody, następnie zabierz ich do zespołów ds. rozwoju, produktu i biznesu, którzy mogą je usunąć i pozostań przy nich, dopóki tego nie zrobią. Trzymaj ludzi w stosunku do wyników: odróżnij wysiłek od uzyskanych wyników, powiedz wyraźnie, kiedy się różnią, i odzwierciedl to w ocenach i decyzjach dotyczących wynagrodzeń.
Wprowadź nowych stolarzy aż do ich pierwszego niezależnego zaangażowania. Trenuj SA w silniejszych inżynierów i skuteczniejszych komunikatorów oraz wykonuj świadome rozmowy o tym, kto jest gotowy na większy zakres. Własna dostawa.
Bądź odpowiedzialny za wyniki realizacji swojego zespołu: czas od rozpoczęcia PoC do pierwszego zoptymalizowanego dedykowanego punktu końcowego, współczynnik trafień kryteriów sukcesu oraz jakość relacji technicznej po przejściu klienta do produkcji. Przejrzyj prace techniczne, zanim dotrą one do klienta: metodologia testów porównawczych, konfiguracje obsługi, wyniki, dokumenty zamknięcia; wychwycić błędne wnioski wyciągnięte z artefaktu metryk, zanim zobaczy go klient. Zapewnić obsadę kadrową i pokrycie eskalacji na różnych kontach i w strefach czasowych, w tym obciążenie żądań posprzedażowych, które nie przestrzega granic sprintu.
Wcześnie zgłaszaj niewykonalność i przedstawiając dowody, zamiast pozwalać zespołowi palić iteracje pod kątem wymagań, których platforma nie jest w stanie dzisiaj spełnić. szablony. Zadbaj o dokładność i dostępność; link, nie kopiuj Korzystaj z tego, a nie tylko pisz: dokumentacja, której nikt nie czyta, to koszt, a nie zasób. Utrzymuj moduł śledzenia zgłoszeń w systemie rejestrów, aby PoC i status produkcji były czytelne bez pytania kogokolwiek.
Instrumentuj pracę: zdefiniuj i raportuj wskaźniki, które pokazują, czy dostawa staje się z czasem szybsza i bardziej niezawodna. Praca między zespołami. Zespoły rozwojowe i badawcze: przekształcaj powtarzające się problemy klientów w priorytetową pracę nad platformą i reprezentuj rzeczywistość techniczną klienta w dyskusjach na temat planów działania.
Przedsprzedaż: wstrzymaj się. granica zakresu od realizacji: wycofywanie zleceń o niepełnym zakresie i przekazywanie sygnału wykonalności z powrotem na wyższy poziom Zarządzanie kontem: dbanie o to, aby przekazywanie produkcji przebiegało bez zakłóceń i utrzymywanie realizacji żądań technicznych po sprzedaży Biznes i przywództwo: bezpośrednia ocena stanu konta, wykonalności technicznej i potrzeb w zakresie wydajności Oczekujemy, że będziesz mieć: ponad 3 lata zarządzania zespołami technicznymi, w tym zarządzanie wydajnością i trudne rozmowy Doświadczenie w zarządzaniu zespołem mającym kontakt z klientem. Prowadzenie zespołu, którego praca jest widoczna dla klientów, na osi czasu klienta, przy eskalacjach klientów. Dobra znajomość uczenia maszynowego: architektury LLM, podejścia do dostrajania (SFT/LoRA, oparte na RL), projekt ewaluacji i działająca znajomość wewnętrznych elementów wnioskowania - kwantyzacja, zarządzanie pamięcią podręczną KV, przetwarzanie wsadowe, routing, dekodowanie spekulatywne - oraz frameworków, w których pracuje zespół (vLLM, SGLang, TensorRT-LLM).
Wystarczająca ocena techniczna, aby przejrzeć cudzy test porównawczy i znaleźć błąd w metodologii, a nie tylko we wnioskach Python wystarczająco mocny, aby czytaj i przeglądaj kod swojego zespołu Doskonałe umiejętności komunikacyjne, z możliwością jasnego wyjaśniania koncepcji technicznych różnym odbiorcom, od inżynierów po kadrę kierowniczą, w tym przed klientami korporacyjnymi znajdującymi się pod presją Prawdziwa tolerancja dla pracy operacyjnej: dokumentacja, projektowanie procesów, raportowanie i monitorowanie, które ich trzyma. Komfort pracy z niejednoznacznością w rozproszonych zespołach i strefach czasowych oraz skłonność do zapisywania rzeczy. Będzie to dodatkowy bonus, jeśli posiadasz: Referencje zarówno od byłych menedżerów, jak i byłych bezpośrednich podwładnych.
Doświadczenie w skalowaniu zespołu poprzez szybki rozwój (5 → 15+) bez utraty jakości dostawy Wcześniejsze doświadczenie w funkcji technicznej skierowanej do klienta w chmurze, wnioskowaniu lub u dostawcy infrastruktury AI Doświadczenie w definiowaniu procesów i dokumentacji dla zespołu, który nie miał żadnego Praktyczne doświadczenie w prowadzeniu LLM w produkcji i debugowaniu obciążeń wnioskowania na poziomie frameworka Praca z multimodalnymi modelami AI (język wizyjny, mowa) Biegłość w zakresie narzędzi DevOps (Docker, Kubernetes) i infrastruktury jako kodu Preferowany stos techniczny: Języki programowania: Python ML frameworki i biblioteki: vLLM, TensorRT-LLM, SGLang, Transformers, OpenAI/Anthropic SDK Narzędzia MLOps i DevOps: Kubernetes (K8s), Docker, Git Platformy chmurowe: AWS (SageMaker, Bedrock), GCP (Vertex AI), Azure (Azure ML) Korzyści i atuty: Konkurencyjne wynagrodzenie Możliwość rozwoju kariery i uczenia się Elastyczność i własność Kultura współpracy i innowacyjności Możliwość pracy nad wpływowe projekty AI Międzynarodowe środowisko i utalentowane zespoły Jak to jest pracować w Nebius: Szybkość działania - Odważne myślenie - Ciągły rozwój - Znaczący wpływ - Zaufanie i prawdziwa własność - Możliwość kształtowania przyszłości AI Oświadczenie o równych szansach: Nebius jest pracodawcą zapewniającym równe szanse. Zależy nam na wspieraniu włączającego i zróżnicowanego miejsca pracy oraz zapewnianiu równych możliwości zatrudnienia we wszystkich aspektach zatrudnienia. Nie dyskryminujemy ze względu na rasę, kolor skóry, religię, płeć (w tym ciążę), narodowość, pochodzenie, wiek, niepełnosprawność, informacje genetyczne, stan cywilny, status weterana, orientację seksualną, tożsamość lub ekspresję płciową lub jakąkolwiek inną cechę chronioną przez obowiązujące prawo.
Kandydaci muszą posiadać zezwolenie na pracę w kraju, w którym składają wniosek, a jako warunek zatrudnienia będą zobowiązani do przedstawienia dowodu potwierdzającego uprawnienia do zatrudnienia. Jeśli potrzebujesz zakwaterowania w trakcie procesu aplikacyjnego, daj nam znać. Pierwotnie opublikowany w Himalajach
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.