O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
Inżynier oprogramowania, platforma GenAI Informacje o zespole Zespół platformy GenAI firmyDeliveroo działa w ramach platformy uczenia maszynowego i buduje wspólną infrastrukturę, która pomaga zespołom DoorDash, Wolt i Deliveroo bezpiecznie wprowadzać do produkcji produkty, agenty, automatyzację i personalizację oparte na GenAI. Naszą misją jest zwiększenie szybkości oddziaływania biznesowego z GenAI. Głównym filarem tej pracy jest samodzielne uruchamianie pionierskich, otwartych rozwiązań LLM i VLM (takich jak GLM, Qwen, Kimi i DeepSeek) - obsługa procesora graficznego w czasie rzeczywistym, wnioskowanie wsadowe o wysokiej przepustowości i dostrajanie autoskalowanych procesorów graficznych - zapewniając duże korzyści w zakresie kosztów i opóźnień (na przykład miliard osadzonych wygenerował około 20 razy taniej, a modele wizualne były dostępne około 72% taniej).
Posiadamy również podstawowe powierzchnie platform, w tym LLM Gateway, Agent Gateway, infrastrukturę evals, poręcze i atrybucję kosztów. Informacje o roli Dołączysz do małej, wysokowydajnej infrastruktury produkcyjnej do budowania zespołów na potrzeby generatywnej sztucznej inteligencji w firmach Deliveroo i DoorDash, ze szczególnym naciskiem na naszą platformę modeli o otwartych wagach obejmującą wnioskowanie i dostrajanie: obsługę procesora graficznego w czasie rzeczywistym, wnioskowanie wsadowe o wysokiej przepustowości i dostrajanie modelu. Będziesz pracować z silnikami udostępniania i wnioskowania modeli, potokami dostrajania i uczenia, automatycznym skalowaniem i wykorzystaniem procesora graficznego, potokami wsadowymi, usługami zaplecza i obserwowalnością.
Ta rola jest idealna dla inżyniera, który lubi przekraczać granicę kosztów/wydajności w zakresie wnioskowania o GPU i dostrajania w szybko zmieniającym się obszarze technicznym, w którym potrzeby produktów, możliwości modeli, ekosystemy dostawców i kompromisy między kosztami a wydajnością szybko ewoluują. Cieszysz się z tej możliwości, ponieważ… Zbudujesz infrastrukturę, która pomoże zespołom Deliveroo przenosić pomysły GenAI z prototypu do produkcji, zwiększając szybkość wpływu AI na biznes w całej firmie. Pracuj nad naszym stosem obsługującym otwarte wagi - punktami końcowymi GPU w czasie rzeczywistym, wysokoprzepustowe wnioskowanie wsadowe i dostrajanie (SFT/DPO/LoRA) - wraz z bramkami LLM, agentami Gateway, infrastrukturą ewaluacyjną, barierami ochronnymi i atrybucją kosztów.
Projektuj skalowalne, wysokowydajne systemy do obsługi modeli, wnioskowania wsadowego, automatycznego skalowania GPU i dostrajania, które wspomagają przypadki użycia rzeczywistych klientów i automatyzacji wewnętrznej. Przesuń granicę kosztów i opóźnień wnioskowania GPU - zamieniając zadania wsadowe, które zajmowały dni w godziny, i obniżając koszty wnioskowania o wielokrotności - dając jednocześnie zespołom produktowym wybór pomiędzy modelami o otwartym i zamkniętym kodzie źródłowym z wbudowaną niezawodnością, rezerwą, obserwowalnością i kontrolą kosztów. Twórz platformy obsługujące szybkie eksperymenty, spełniając jednocześnie standardy produkcyjne w zakresie opóźnień, skalowania, monitorowania, docelowych poziomów usług, podręczników i doskonałości operacyjnej. Ściśle współpracuj z inżynierami ML, inżynierami produktu, analitykami danych i zespołami ds. platform w DoorDash, Wolt i Deliveroo, aby przekształcić pojawiające się możliwości GenAI w trwałe prymitywy platform.
Kształtuj przyszłość scentralizowana platforma GenAI - obejmująca nowe kierunki, takie jak uczenie się przez wzmacnianie (RLHF/RLVR), optymalizacja agentów i inne techniki poszkoleniowe i agentyczne - umożliwiająca następną generację produktów, agentów, automatyzacji i personalizacji opartych na sztucznej inteligencji. Cieszymy się z Ciebie, ponieważ masz… licencjat, magistra lub doktora informatyki lub równoważny. Ponad 3 lata doświadczenia w branży w inżynierii oprogramowania.
Solidne podstawy inżynierii backendu, zwłaszcza w języku Python i systemach rozproszonych. Doświadczenie w budowaniu usług produkcyjnych, interfejsów API, potoków danych lub Infrastruktura uczenia maszynowego na dużą skalę.Doświadczenie w produkcji systemów operacyjnych, w tym obserwowalność, debugowanie, niezawodność, reakcja na incydenty i optymalizacja wydajności/kosztów.Praktyczne doświadczenie w wnioskowaniu LLM i/lub dostrajaniu otwartych modeli w środowisku produkcyjnym - obsługa (opóźnienia, przepustowość, przetwarzanie wsadowe, automatyczne skalowanie, wykorzystanie procesora graficznego) i/lub dostrajanie (SFT/DPO/LoRA).Umiejętność pracy w niejednoznacznych, szybko zmieniających się obszarach technicznych i przekształcania przypadków użycia klientów w możliwości platformy wielokrotnego użytku Biegłość w korzystaniu z narzędzi do kodowania AI (np. Claude Code, Codex, Cursor) w pełnym cyklu życia tworzenia oprogramowania, w tym w projektowaniu, generowaniu kodu, testowaniu, monitorowaniu i wydawaniu oprogramowaniaMiła miećDoświadczenie z silnikami wnioskowania LLM i frameworkami obsługującymi (np. vLLM, SGLang, TensorRT-LLM) w produkcjiDoświadczenie z rozproszonymi/wielowęzłowymi potokami dostrajania i szkolenia (SFT, DPO/RLHF, LoRA), w tym przygotowanie i ocena danych.
Praca nad wydajnością GPU - wnioskowanie wielowęzłowe/rozproszone, optymalizacja pamięci podręcznej KV/pamięci, kwantyzacja (FP8/INT8/AWQ/GPTQ) lub dostrajanie zimnego startu/przepustowości. Doświadczenie z Kubernetes, infrastrukturą chmurową (AWS/GCP), procesorami graficznymi, bezserwerowymi/elastycznymi platformami GPU (np. Modal) lub wysokoprzepustowymi systemami wsadowymi.
Doświadczenie w LLM. bramy, routing modeli, abstrakcja dostawców lub atrybucja kosztówDoświadczenie w budowaniu platform programistycznych, platform wewnętrznych lub infrastruktury samoobsługowejDoświadczenie w budowaniu i wdrażaniu agentów AI lub serwerów MCP w produkcjiDoświadczenie z systemami eval, obserwowalnością LLM, śledzeniem, RAG, wyszukiwaniem lub wektorowymi bazami danychRóżnorodność, równość i włączenie W Deliveroo wiemy, że świetne miejsce pracy odzwierciedla otaczający nas świat i że prawdziwa różnorodność i włączenie czynią nas silniejszymi, bardziej kreatywnymi i lepszymi w tym, co robimy zrobić. Zależy nam na tworzeniu środowiska, w którym każdy może wykonywać swoją najlepszą pracę i czuć, że przynależy. Wierzymy w równość szans i zapraszamy kandydatów ze wszystkich środowisk, bez względu na wiek, płeć, pochodzenie etniczne, niepełnosprawność, orientację seksualną, tożsamość płciową, pochodzenie społeczno-ekonomiczne, religię lub przekonania.
Jeśli jesteś niepełnosprawny lub cierpisz na długotrwałe problemy zdrowotne i potrzebujesz wsparcia, aby ubiegać się o jedno z naszych stanowisk lub potrzebujesz uzasadnionych dostosowań w procesie rekrutacji, będziesz mieć możliwość poinformowania nas o tym po przesłaniu aplikacji. Podzielimy się szczegółowymi informacjami na temat tego, jak poprosić o wsparcie, abyśmy mogli zapewnić Ci uczciwe i równe doświadczenie. Jeśli nie możesz się doczekać wywarcia realnego wpływu na szybko zmieniającym się rynku i rozwoju swojej kariery w towarzystwie ambitnych, wspierających się zespołów, chętnie się z Tobą skontaktujemy!
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.