O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
Informacje o RadiantRadiant na nowo definiuje sposób budowania infrastruktury sztucznej inteligencji. Projektujemy i obsługujemy platformy chmurowe natywne dla sztucznej inteligencji, zaprojektowane pod kątem suwerenności, wydajności i skali. Nasza infrastruktura obsługuje obciążenia natywne dla procesorów graficznych, płaszczyzny sterowania obsługujące wielu dzierżawców i wysokowydajne systemy sztucznej inteligencji zaprojektowane z myślą o najbardziej wymagających środowiskach.
Nie budujemy ogólnej chmury. Budujemy specjalnie opracowaną infrastrukturę sztucznej inteligencji - od zasilanych gruntów, przez obliczenia, po oprogramowanie. W miarę skalowania naszej platformy i rozwijania naszej organizacji inżynieryjnej szukamy liderów, którzy potrafią budować silne zespoły, utrzymywać wysokie standardy i dostarczać niezawodnie w odpowiednim tempie.
Jako część zespołu ds. rozwiązań infrastrukturalnych, Cluster Architect jest czołówką wiodących nowych wdrożeń procesorów graficznych Radiant. Cluster Architect współtworzy strategię techniczną, architekturę referencyjną i standardy zarządzania leżące u podstaw platformy obliczeniowej GPU Radiant. Tłumaczą zaawansowane projekty dostarczone przez organizację Customer Success na w pełni działające superkomputery.
We współpracy z zespołem Datacenter Engineering kierują definicją niskopoziomowego projektu przyszłych wdrożeń infrastruktury obliczeń o wysokiej wydajności (HPC) i sztucznej inteligencji (AI). Musisz umieć znajdować rozwiązania, być w stanie dostosować się do rozwijającej się technologii i wymagań klientów oraz być gotowym na radzenie sobie ze skalą. Właściwa osoba na to stanowisko będzie skupiona na kwestiach technicznych i szczegółowa oraz zdolna do współpracy z szerszym zespołem, aby z powodzeniem dostarczyć jedne z największych superkomputerów na świecie w szybkim tempie i z dużą precyzją.
Dokumentowanie każdego etapu procesu jest niezwykle istotne, aby umożliwić efektywną komunikację z interesariuszami wewnętrznymi i zewnętrznymi. Informacje o zespole ds. infrastruktury Zespół inżynierii infrastruktury stoi na czele strategii, planu działania i dostarczania krytycznej infrastruktury HPC/AI szerzej rozumianym organizacjom zajmującym się technologią i klientami. Jej misją jest wdrażanie skalowalnych, bezpiecznych i wydajnych rozwiązań infrastrukturalnych dostosowanych do strategicznych potrzeb organizacji.
Zespół definiuje architekturę referencyjną superkomputerów Radiant zgodnie z klientem, oprogramowaniem i wymaganiami operacyjnymi firmy. Ściśle współpracuje z dostawcami zewnętrznymi w celu dostarczania i utrzymywania listy technologii stanowiących część oferty Radiant. Zapewnia wsparcie techniczne w całym procesie zaopatrzenia z dostawcami, aby zapewnić przydatność odpowiedzi na RFI/RFP. Współpracują z producentami OEM i dostawcami infrastruktury podczas wdrażania infrastruktury oraz zapewniają dane techniczne dostawcom DC i OEM. Ściśle współpracują z dostawcami prądu stałego i producentami OEM. zarządzania programami i dopasowuje programy wdrażania infrastruktury sprzętowej do równoległych programów wyposażenia centrów danych i programów inżynierii oprogramowania.
Odgrywają one zasadniczą rolę w pomyślnym wdrożeniu infrastruktury chmury, zapewniając jednocześnie optymalną wydajność i niezawodność w środowiskach obliczeniowych o wysokich wymaganiach. Po zaakceptowaniu rozwiązania infrastrukturalne są następnie przekazywane zespołowi ds. operacji infrastruktury, który zarządza codziennym zarządzaniem infrastrukturą. Co będziesz robić Nawiąż kontakt z kluczowymi interesariuszami (takimi jak biuro zarządzania programami, zespoły inżynierii centrum danych, inżynieria rozwiązań i zespoły ds. operacji infrastruktury) i przełóż dane wejściowe na architekturę referencyjną Radiant i plany projektów niskiego poziomu.
Bądź na bieżąco z postępem technologicznym i planami działania z kluczowymi dostawcami w branży. Kieruj projektowaniem niskiego poziomu sztucznej inteligencji o dużej gęstości systemy superkomputerowe (obliczenia, połączenia międzysystemowe, pamięć masowa, zarządzanie). Uczestnictwo w Radzie Przeglądu Architektury obejmującej kluczowe zainteresowane strony, aby zapewnić współpracę i zgodność firmy z tworzonymi projektami.
Oceniaj kompromisy między wydajnością, zasilaniem, chłodzeniem, serwisowalnością i kosztami w całym procesie zaopatrzenia. We współpracy z potencjalnymi dostawcami kieruj tworzeniem szczegółowych projektów niskiego poziomu, w tym (ale nie ograniczając się do): Schematów i układów elewacji szaf serwerowych Plany pięter centrów danych i planowanie przestrzenne Architektura dystrybucji zasilania i chłodzenia oraz powiązane szczegółowe specyfikacje Szczegółowy rachunek kosztów Materiały (BoM) Dokumenty mapowania portów. Przeprowadzaj dokładne oceny techniczne i dokładność odpowiedzi od dostawców podczas procesów RFx, upewniając się, że projekty są zgodne z możliwościami dostawcy i ograniczeniami dotyczącymi elementów o długim terminie realizacji.
Odgrywaj praktyczną i aktywną rolę w produkcji, wypalaniu, okablowaniu, konfiguracji logicznej, testach porównawczych i logicznym wdrażaniu nowych wdrożeń, aby przekształcić projekty w systemy klasy produkcyjnej. Kieruj kryteriami akceptacji, mając na uwadze cele w zakresie jakości, niezawodności, bezpieczeństwa i wydajności. Współpracuj z zespołami inżynierii oprogramowania i inżynierii rozwiązań, aby zapewnić infrastrukturę wspiera wymagania dotyczące obciążenia sztuczną inteligencją.
Angażuj się w zarządzanie projektami, aby zdefiniować kamienie milowe, ryzyko, zasoby i elementy dostarczane związane z dostawą. Twórz dokładne diagramy architektury, dokumentację konfiguracyjną, elementy Runbook i wytyczne operacyjne, aby ułatwić przekazywanie nowych wdrożeń zespołowi ds. Operacji infrastruktury.
Ustal najlepsze praktyki w zakresie dostarczania i stale ulepszaj projekty, procesy i dokumentację poprzez udział w warsztatach „wyciągniętych wniosków”. Wymagania BSc w dziedzinie informatyki, inżynierii elektrycznej/komputera, fizyki, Matematyka lub inna pokrewna dziedzina inżynierii. Ponad 5 lat doświadczenia w architekturze rozwiązań, wykazujące motywację i umiejętności do kierowania projektowaniem technicznym i procesami dostaw.
Głęboka wiedza specjalistyczna w zakresie inżynierii centrów danych (mechanicznych, elektrycznych i hydraulicznych), systemów GPU, sieci o wysokiej wydajności (takich jak InfiniBand), w tym sprawdzone zrozumienie topologii sieci i architektury pamięci masowej. Biegłość w aspektach na poziomie systemu, obejmujących systemy operacyjne, sterowniki jądra Linux, procesory graficzne, karty sieciowe i rozwiązania w zakresie oprogramowania infrastrukturalnego. Wykazane doświadczenie w tworzeniu szczegółowych projektów infrastruktury (w tym topologie sieci, układy szaf, BoM, planowanie zasilania/chłodzenia…)Dogłębne zrozumienie wyposażenia centrum danych oraz ograniczeń zasilania/chłodzeniaDoskonałe umiejętności interpersonalne i komunikacyjne, z doświadczeniem w kontaktach z różnymi typami interesariuszy (zespoły inżynieryjne/operacyjne, dostawcy itp.) i pisaniu jasnych wyników.Wygodna praca w szybko zmieniających się i skomplikowanych środowiskach technicznych.Miło jest mieć wcześniejsze doświadczenie zawodowe w HPC, Środowiska telekomunikacyjne lub hiperskalowe do projektowania, dostarczania i/lub obsługi wielkoskalowych systemów HPC.Doświadczenie w pracy lub badaniach w zakresie podstaw sieci, stosu TCP/IP i projektów centrów danych.Znajomość systemów monitorowania/telemetrii i obserwowalności stanu infrastruktury.Wykazana wiedza specjalistyczna w zakresie oprogramowania do orkiestracji chmur i harmonogramów zadań, w tym platform takich jak Kubernetes, Docker Swarm i harmonogramów specyficznych dla HPC, takich jak Slurm.Znajomość Technologie DevOps/MLOps, takie jak Docker/kontenery, Kubernetes, wdrożenia w centrach danych/sieci/magazynach.
Praktyczne doświadczenie z systemami NVIDIA/SDK (np. CUDA), technologiami sieciowymi NVIDIA (np. DPU, RoCE, InfiniBand), rozwiązaniami procesorów ARM w połączeniu ze znajomością programowania C/C++, programowania równoległego i rozwoju procesorów graficznych.
Dlaczego warto do nas dołączyć? To, co nas wyróżnia, to połączenie nowoczesnej technologii, konkurencyjnych korzyści i otwartej, przyjaznej kultury pracy, która umożliwia naszym pracownikom rozwój. Oto tylko niektóre ze wspaniałych rzeczy, których możesz od nas oczekiwać: 25 dni corocznego urlopuKultura kładąca nacisk na wyniki ponad hierarchię, proces i ego: kładziemy duży nacisk na jakość, pomysłowość i kreatywność pracy.Otwarta komunikacja, regularne informacje zwrotne: cenimy płynną współpracę, bezpośrednie i praktyczne informacje zwrotne i wierzymy, że przewodnictwo oparte na empatii i nastawieniu na rozwój czyni nas razem lepszymi.Czas nauki: wszyscy poświęciliśmy czas na naukę, aby skupić się na nowych umiejętnościach, projektach lub zainteresowaniach wykraczających poza codzienne obowiązki praca.Zdrowie i dobre samopoczucie: chcemy, aby wszyscy czuli się zdrowi i szczęśliwi, dlatego oferujemy prywatne ubezpieczenie medyczne za pośrednictwem Bupa.Program „Cycle to Work Scheme”: zależy nam na budowaniu zrównoważonego biznesu, dlatego zachęcamy do korzystania z roweru do pracy.
Subskrypcja Gympass do różnych siłowni i aplikacji zapewniających dobre samopoczucie Uczestnictwo w programie akcji firmy Zwiększona płaca rodzicielska i urlopy Różnorodność, równość, włączenie i przynależność Jesteśmy pracodawcą zapewniającym równe szanse i staramy się ograniczać nieświadome uprzedzenia we wszystkich naszych działaniach proces rekrutacji. Wszyscy kandydaci będą brani pod uwagę pod kątem zatrudnienia bez względu na pochodzenie etniczne, religię, orientację seksualną, tożsamość płciową, status rodzinny lub rodzicielski, pochodzenie narodowe, stopień weterana, status różnorodności neurologicznej lub niepełnosprawność. Aby mieć pewność, że nasze procesy rekrutacyjne zapewniają wszystkim kandydatom równe szanse odniesienia sukcesu, zachęcamy do poinformowania nas, jeśli możemy wprowadzić jakieś zmiany.
Znajdź pracę w Wielkiej Brytanii na Arbeitnow
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.