Starszy inżynier oprogramowania, platforma GenAI
London - The River Building HQ
Do uzgodnienia
O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
Starszy inżynier oprogramowania, infrastruktura uczenia maszynowego - generatywna sztuczna inteligencjaO zespole Zespół GenAI Platform TeamDeliveroo znajduje się w ramach platformy uczenia maszynowego i buduje wspólną infrastrukturę, która pomaga zespołom DoorDash, Wolt i Deliveroo bezpiecznie wprowadzać do produkcji produkty, agenty, automatyzację i personalizację oparte na GenAI. Naszą misją jest zwiększenie szybkości oddziaływania biznesowego z GenAI. Głównym filarem tej pracy jest samodzielne uruchamianie pionierskich, otwartych rozwiązań LLM i VLM (takich jak GLM, Qwen, Kimi i DeepSeek) - obsługa procesora graficznego w czasie rzeczywistym, wnioskowanie wsadowe o wysokiej przepustowości i dostrajanie autoskalowanych procesorów graficznych - zapewniając duże korzyści w zakresie kosztów i opóźnień (na przykład miliard osadzonych wygenerował około 20 razy taniej, a modele wizualne były dostępne około 72% taniej).
Posiadamy również podstawowe powierzchnie platform, w tym LLM Gateway, Agent Gateway, infrastrukturę ewaluacyjną, poręcze i atrybucję kosztów. Informacje o roli Dołączysz do małej, wysokowydajnej infrastruktury produkcyjnej do budowania zespołów na potrzeby Generative AI w firmach Deliveroo i DoorDash, kierując projektowaniem i architekturą naszej platformy modeli o otwartych wagach, obejmującej wnioskowanie i dostrajanie: obsługę procesora graficznego w czasie rzeczywistym, wnioskowanie wsadowe o wysokiej przepustowości i dostrajanie modelu. Wyznaczysz kierunek techniczny w zakresie obsługi modeli i silników wnioskowania, potoków dostrajania i uczenia, automatycznego skalowania i wykorzystania procesora graficznego, potoków wsadowych, usług zaplecza i obserwowalności, a także będziesz mentorem inżynierów.
Ta rola jest idealna dla starszego inżyniera, który lubi posiadanie niejednoznacznych systemów o dużym wpływie i przesuwanie granicy koszt/wydajność w zakresie wnioskowania i dostrajania GPU w szybko zmieniającym się obszarze technicznym, w którym potrzeby produktów, możliwości modeli, ekosystemy dostawców i kompromisy między kosztami a wydajnością szybko ewoluują. Cieszysz się z tej możliwości, ponieważ… Kierujesz projektowaniem infrastruktury, która pomaga zespołom przenosić pomysły GenAI z prototypu do produkcji, zwiększając prędkość wpływu sztucznej inteligencji na biznes w całej firmie. Posiadaj i rozwijaj nasze nasze rozwiązania stos obsługujący otwarte wagi - punkty końcowe GPU w czasie rzeczywistym, wysokoprzepustowe wnioskowanie wsadowe i dostrajanie (SFT/DPO/LoRA) - wraz z bramką LLM, bramką agenta, infrastrukturą ewaluacyjną, barierami ochronnymi i atrybucją kosztów.
Skalowalne dla architektów, wysokowydajne systemy do udostępniania modeli, wnioskowania wsadowego, automatycznego skalowania GPU i dostrajania, które wspierają przypadki użycia rzeczywistego klienta i automatyzacji wewnętrznej Przesuń granicę kosztów i opóźnień GPU wnioskowanie - przekształcanie zadań wsadowych zajmujących dni w godziny i wielokrotne obniżanie kosztów wnioskowania - zapewniając jednocześnie zespołom ds. produktu prosty wybór pomiędzy modelami o otwartym i zamkniętym kodzie źródłowym z wbudowaną niezawodnością, rezerwami awaryjnymi, obserwowalnością i kontrolą kosztów. Twórz platformy, które obsługują szybkie eksperymentowanie, jednocześnie spełniając standardy produkcyjne w zakresie opóźnień, skalowania, monitorowania, SLO, podręczników i doskonałości operacyjnej. Ściśle współpracuj z inżynierami ML, inżynierami produktu, analitykami danych i zespołami ds. platform w DoorDash, a także podnoś poprzeczkę techniczną. Wolt i Deliveroo przekształcą pojawiające się możliwości GenAI w trwałe prymitywne platformy.
Wyznaczą kierunek techniczny na przyszłość scentralizowanej platformy GenAI firmy - w tym nowe kierunki, takie jak uczenie się przez wzmacnianie (RLHF/RLVR), optymalizacja agentów i inne techniki poszkoleniowe i agentyczne - umożliwiające następną generację produktów, agentów, automatyzacji i personalizacji opartych na sztucznej inteligencji. Jesteśmy podekscytowani Twoją obecnością, ponieważ… licencjat, magister lub doktor informatyki lub jego odpowiednik5+ lat doświadczenia w branży w zakresie oprogramowania inżynieriaGłębokie podstawy inżynierii backendu, zwłaszcza w języku Python i systemach rozproszonych.Doświadczenie w projektowaniu i posiadaniu usług produkcyjnych, interfejsów API, potoków danych lub infrastruktury ML na dużą skalę.Doświadczenie w systemach operacyjnych w środowisku produkcyjnym, w tym obserwowalność, debugowanie, niezawodność, reagowanie na incydenty i optymalizacja wydajności/kosztów.Głębokie praktyczne doświadczenie w wnioskowaniu LLM i/lub dostrajaniu modeli o otwartej wadze w produkcji - obsłudze (opóźnienia, przepustowość, przetwarzanie wsadowe, autoskalowanie, wykorzystanie procesora GPU) i/lub dostrajanie (SFT/DPO/LoRA). Wykazane przywództwo techniczne: wiodące projektowanie w niejednoznacznych, szybko zmieniających się obszarach technicznych, mentoring dla inżynierów i przekształcanie przypadków użycia klientów w możliwości platformy wielokrotnego użytku Biegłość w korzystaniu z narzędzi do kodowania AI (np.
Claude Code, Codex, Cursor) w pełnym cyklu życia tworzenia oprogramowania, w tym projektowanie, generowanie kodu, testowanie, monitorowanie i wydawanie oprogramowaniaMiło jest mieć doświadczenie z silnikami wnioskowania LLM i platformami obsługującymi (np. vLLM, SGLang, TensorRT-LLM) w środowisku produkcyjnym Doświadczenie w zakresie dostrajania rozproszonego/wielowęzłowego i potoków szkoleniowych (SFT, DPO/RLHF, LoRA), w tym przygotowanie i ocena danych Praca nad wydajnością GPU - wnioskowanie wielowęzłowe/rozproszone, optymalizacja pamięci podręcznej KV/pamięci, kwantyzacja (FP8/INT8/AWQ/GPTQ) lub zimny start/przepustowość tuningDoświadczenie z Kubernetes, infrastrukturą chmurową (AWS/GCP), procesorami graficznymi, bezserwerowymi/elastycznymi platformami GPU (np. Modal) lub wysokoprzepustowymi systemami wsadowymiDoświadczenie z bramami LLM, routingiem modeli, abstrakcją dostawców lub przypisywaniem kosztówDoświadczenie w budowaniu platform programistycznych, platform wewnętrznych lub infrastruktury samoobsługowejDoświadczenie w budowaniu i wdrażaniu agentów AI lub serwerów MCP w produkcjiDoświadczenie z systemami ewaluacji, obserwowalnością LLM, śledzeniem, RAG, wyszukiwaniem, lub wektorowe bazy danych Różnorodność, równość i włączenie W Deliveroo wiemy, że wspaniałe miejsce pracy odzwierciedla otaczający nas świat i że prawdziwa różnorodność i integracja czynią nas silniejszymi, bardziej kreatywnymi i lepszymi w tym, co robimy. Zależy nam na tworzeniu środowiska, w którym każdy może wykonywać swoją najlepszą pracę i czuć, że przynależy.
Wierzymy w równość szans i zapraszamy kandydatów ze wszystkich środowisk, bez względu na wiek, płeć, pochodzenie etniczne, niepełnosprawność, orientację seksualną, tożsamość płciową, pochodzenie społeczno-ekonomiczne, religię lub przekonania. Jeśli jesteś niepełnosprawny lub cierpisz na długotrwałe problemy zdrowotne i potrzebujesz wsparcia, aby ubiegać się o jedno z naszych stanowisk lub potrzebujesz uzasadnionych dostosowań w procesie rekrutacji, będziesz mieć możliwość poinformowania nas o tym po przesłaniu aplikacji. Podzielimy się szczegółami, jak poprosić o wsparcie, abyśmy mogli zapewnić Ci uczciwe i równe doświadczenie.
Jeśli ekscytuje Cię wywarcie realnego wpływu na szybko zmieniającym się rynku i rozwój swojej kariery w ambitnych, wspierających się zespołach, chętnie się z Tobą skontaktujemy! Znajdź więcej anglojęzycznych ofert pracy w Wielkiej Brytanii na Arbeitnow
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.