Inżynier infrastruktury (GPU i obliczenia)
London; New York, New York, United States; San Francisco, California, United States; Seattle, Washington, United States
Do uzgodnienia
O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
<div class="content-intro"><h2>Kim <strong>jesteśmy</strong></h2> <p>Lightning AI to firma stojąca za PyTorch Lightning. Założona w 2019 roku, budujemy kompleksową platformę do opracowywania, szkolenia i wdrażania systemów AI - zaprojektowaną tak, aby przy mniejszym tarciu przenosić pomysły z badań do produkcji.</p> <p>Dzięki naszej fuzji zvoltage Park, neocloudem i fabryką sztucznej inteligencji, Lightning AI łączy oprogramowanie przeznaczone dla programistów z ekonomicznymi obliczeniami na dużą skalę. Zespoły otrzymują narzędzia potrzebne do eksperymentowania, szkolenia i wnioskowania produkcyjnego z wbudowanymi zabezpieczeniami, obserwowalnością i kontrolą.</p> <p>Obsługujemy indywidualnych badaczy, start-upy i duże przedsiębiorstwa.
Lightning AI działa na całym świecie z biurami w Nowym Jorku, San Francisco, Seattle i Londynie i jest wspierana przez Coatue, Index Ventures, Bain Capital Ventures i Firstminut.</p> <h2 class="PDq2pG_selectionAnchorContainer" data-section-id="o4nw1n" data-start="0" data-end="18">Sposób, w jaki pracujemy</h2> <p data-start="20" data-end="222">Ludzie, którzy dobrze się tutaj rozwijają, to budowniczowie, którzy działają szybko, komunikują się otwarcie, przejmują odpowiedzialność i stale ulepszają siebie, swoje zespoły i naszą firmę. Oto jak to wygląda w praktyce:</p> <ul> <li data-section-id="vkpt18" data-start="319" data-end="461"><strong data-start="321" data-end="343">Działamy pilnie:</strong> Działamy szybko, podejmujemy przemyślane decyzje i utrzymujemy dynamikę. Przedkładamy działanie nad perfekcję i uczymy się poprzez wysyłkę.</li> <li data-section-id="1c7e9p5" data-start="462" data-end="598"><strong data-start="464" data-end="483">Przejmij odpowiedzialność:</strong> Jesteśmy właścicielami wyników, a nie tylko naszej indywidualnej pracy.
Podejmujemy decyzje, które popychają firmę do przodu i prowadzą ją dalej.</li> <li data-section-id="1wm6yoj" data-start="599" data-end="751"><strong data-start="601" data-end="624">Komunikujemy się otwarcie:</strong> Komunikujemy się bezpośrednio, staramy się zrozumieć i zapewnić innym przejrzystość. Szczere rozmowy pomagają nam działać szybciej.</li> <li data-section-id="1w7531e" data-start="752" data-end="874"><strong data-start="754" data-end="776">Tworzymy świetne zespoły:</strong> Dajemy przykład, wzmacniamy innych i tworzymy zdrowe zespoły, w których ludzie mogą wykonywać swoją pracę najlepiej, jak potrafią.</li> <li data-section-id="jb6f5l" data-start="875" data-end="1036"><strong data-start="877" data-end="895">Podnieś poprzeczkę:</strong> Zawsze się doskonalimy. Uczymy się na podstawie opinii, stale stawiamy sobie wyzwania, aby się rozwijać i skupiamy na pracy, która jest najważniejsza.</li> <li data-section-id="12lc0uc" data-start="1037" data-end="1184"><strong data-start="1039" data-end="1059">Myśl długoterminowo:</strong> Projektujemy z myślą o przyszłości.
Tworzymy skalowalne systemy, upraszczamy złożoność oraz wykorzystujemy sztuczną inteligencję i automatyzację, aby zwiększyć nasz wpływ.</li> </ul> <div class="c-message_actions__container c-message__actions"> </div></div><h2><strong>Czego szukamy</strong></h2> <p>Lightning AI poszukuje <strong>inżyniera infrastruktury graficznej i obliczeniowej</strong>, który dołączy do naszego inżynierii infrastruktury zespołu.</p> <p>W tej roli będziesz odpowiadać za zarządzanie obrazami, diagnostykę systemu i weryfikację wielkoskalowej infrastruktury obliczeniowej typu bare-metal, ze szczególnym naciskiem na systemy z obsługą GPU. Będziesz pracować na styku sprzętu, systemów i oprogramowania - opracowując automatyzację, poprawiając niezawodność i umożliwiając wydajne tworzenie klastrów dla obciążeń AI/ML i HPC.</p> <p>Będziesz odgrywać kluczową rolę w posiadaniu i rozwijaniu naszego potoku obrazów, prowadzeniu środowisk walidacyjnych i klastrów testowych oraz wspieraniu kwalifikacji sprzętu na poziomie systemu i sprzętu GPU. Ta rola ma kluczowe znaczenie dla zapewnienia, że nasza infrastruktura jest spójna, wydajna i gotowa do obsługi wymagających obciążeń AI od pierwszego dnia.</p> <p data-start="1156" data-end="1429" data-is-last-node="" data-is-only-node=""><em>Ta rola jest zlokalizowana w jednym z naszych centrów (Nowy Jork, SF, Seattle lub Londyn), z co najmniej 2 dniami w biurze w tygodniu i sporadycznym zespołem i firmą poza siedzibą.
W tej chwili nie jesteśmy w stanie zapewnić sponsoringu wizowego dla tego stanowiska.</em></p> <h2><strong>Co zrobisz</strong></h2> <h3><strong>Infrastruktura systemów, obrazów i walidacji</strong></h3> <ul> <li>Własne i rozwijane systemy do zarządzania obrazami, wdrażania i sprawdzania poprawności w infrastrukturze typu „bare-metal”</li> <li>Uruchamianie i utrzymywanie klastrów testowych używanych do sprawdzania poprawności systemu, diagnostyki i wprowadzenie</li> <li>Weryfikacja oprogramowania sprzętowego, sterowników i obrazów systemu operacyjnego w systemach obliczeniowych i systemach obsługujących procesory graficzne</li> <li>Wspieranie wysiłków w zakresie kwalifikacji sprzętu dla platform nowej generacji</li> </ul> <h3><strong>Diagnostyka i wydajność GPU</strong></h3> <ul> <li>Własna diagnostyka GPU i przepływy pracy weryfikacyjne w infrastrukturze dużej skali</li> <li>Diagnozowanie i rozwiązywanie złożonych problemów związanych z procesorami graficznymi, sterownikami, systemem operacyjnym i sprzętem warstwy</li> <li>Analizuj wydajność systemu i procesora graficznego za pomocą narzędzi takich jak NVIDIA DCGM</li> <li>Identyfikuj wzorce awarii i wprowadzaj ulepszenia w zakresie stabilności systemu i zasięgu walidacji</li> </ul> <h3><strong>Automatyzacja i narzędzia</strong></h3> <ul> <li>Twórz i utrzymuj automatyzację na potrzeby udostępniania, sprawdzania poprawności i uruchamiania systemu</li> <li>Tworzyj narzędzia i przepływy pracy oparte na języku Python w celu poprawy wydajności i zmniejszenia narzutów związanych z ręczną obsługą</li> <li>Zwiększ niezawodność, powtarzalność i skalowalność potoków obrazów i systemów walidacji</li> </ul> <h3><strong>Systemy i operacje</strong></h3> <ul> <li>Zarządzaj systemami opartymi na systemie Linux i obsługuj je w środowiskach produkcyjnych i walidacyjnych</li> <li>Zarządzaj technologią wirtualizacji</li> <li>Obsługuj przepływy pracy oparte na bare-metal, w tym systemy PXE i systemy oparte na obrazach</li> <li>Interfejs z systemami zarządzania sprzętem (np. IPMI, Redfish) do monitorowania i debugowania</li> </ul> <h3><strong>Współpraca międzyfunkcyjna</strong></h3> <ul> <li>Współpraca z zespołami ds. infrastruktury, sprzętu i centrów danych w zakresie wdrażania i sprawdzania systemów</li> <li>Współpraca z zespołami ds. platform i uczenia maszynowego, aby zapewnić, że systemy spełniają wymagania dotyczące obciążenia pracą</li> <li>Wkład w najlepsze praktyki w zakresie udostępniania, diagnostyka i zarządzanie cyklem życia infrastruktury</li> </ul> <h2><strong>Czego będziesz potrzebować</strong></h2> <h3><strong>Wymagane kwalifikacje</strong></h3> <ul> <li>Ponad 5 lat doświadczenia w inżynierii infrastruktury, inżynierii systemów lub na stanowiskach pokrewnych</li> <li>Doświadczenie w pracy z systemami Linux w środowiskach produkcyjnych</li> <li>Praktyczne doświadczenie z systemami i narzędziami obsługującymi GPU, takimi jak NVIDIA DCGM</li> <li>Znajomość obsługi bare-metal i procesów uruchamiania systemu</li> <li>biegłość w języku Python lub podobnych językach skryptowych/programowania na potrzeby automatyzacji</li> <li>Umiejętność debugowania złożonych problemów ze sprzętem, systemem operacyjnym, procesorami graficznymi i oprogramowaniem systemowym</li> </ul> <h3><strong>Idealne doświadczenie</strong></h3> <ul> <li>Doświadczenie z wysokowydajnymi połączeniami wzajemnymi (np. InfiniBand, NVLink)</li> <li>Doświadczenie ze środowiskami rozruchowymi PXE, systemami LiveCD lub przepływami pracy opartymi na obrazach</li> <li>Doświadczenie z interfejsami zarządzania sprzętem, takimi jak iDRAC, IPMI lub Redfish</li> <li>Doświadczenie w obsłudze centrów danych, w tym praca ze sprzętem fizycznym</li> <li>Doświadczenie we wspieraniu obciążeń AI/ML lub HPC na dużą skalę</li> <li>Doświadczenie ze strukturami walidacji GPU lub procesy kwalifikacji sprzętu na dużą skalę</li> </ul> <p></p> <h2>Wynagrodzenie</h2><div class="content-pay-transparency"><div class="pay-input"><div class="description"><p>Dążymy do oferowania konkurencyjnego wynagrodzenia, które odzwierciedla wartość, jaką każdy członek zespołu wnosi do naszej misji.
Ostateczne oferty opierają się na takich czynnikach, jak doświadczenie, umiejętności, lokalizacja geograficzna i oczekiwania dotyczące stanowiska. Oprócz wynagrodzenia podstawowego nasz całkowity pakiet nagród dla kwalifikujących się stanowisk obejmuje premię uznaniową, znaczący składnik kapitałowy i kompleksowe świadczenia.</p></div><div class="title">Przewidywany roczny zakres podstawowego wynagrodzenia na tym stanowisku wynosi:</div><div class="pay-range"><span>180 000 USD</span><span class="divider"> - </span><span>220 000 USD USD</span></div></div></div><div class="content-conclusion"><h2><strong>Świadczenia i korzyści</strong></h2> <p>Oferujemy kompleksowy i konkurencyjny pakiet świadczeń zaprojektowany, aby wspierać zdrowie, dobre samopoczucie i długoterminowy sukces naszych pracowników:</p> <ul> <li data-section-id="q6vq6g" data-start="165" data-end="277"><strong data-start="167" data-end="201">Kompleksowe ubezpieczenie zdrowotne:</strong> Ubezpieczenie medyczne, dentystyczne i okulistyczne dla pracowników i uprawnionych osób na ich utrzymaniu.</li> <li data-section-id="1xm1x4d" data-start="278" data-end="371"><strong data-start="280" data-end="302">Znaczący kapitał:</strong> Jednostki RSU, które dają pracownikom udziały w długoterminowy sukces firmy.</li> <li data-section-id="s036um" data-start="372" data-end="454"><strong data-start="374" data-end="397">Oszczędności na emeryturę:</strong> 401(k) wyrównawcze (USA) i składki emerytalne (Wielka Brytania).</li> <li data-section-id="1nhc2mt" data-start="455" data-end="555"><strong data-start="457" data-end="479">Elastyczny czas wolny:</strong> Nieograniczona WOM, święta firmowe i urlopy płatne w celu wspierania równowagi między życiem zawodowym a prywatnym.</li> <li data-section-id="1b75qw" data-start="556" data-end="657"><strong data-start="558" data-end="588">Przerwa zimowa obejmująca całą firmę:</strong> Dwa tygodnie zamknięcia firmy każdej zimy w celu odłączenia się i naładowania baterii.</li> <li data-section-id="4ppcbu" data-start="658" data-end="769"><strong data-start="660" data-end="693">Płatny urlop rodzicielski i rodzinny:</strong> płatny urlop zapewniający wsparcie Tobie i Twojej rodzinie w ważnych momentach życia.</li> <li data-section-id="1fdupxa" data-start="770" data-end="880"><strong data-start="772" data-end="801">Rozwój zawodowy:</strong> roczny dodatek na naukę i rozwój wspierający Twój rozwój zawodowy.</li> <li data-section-id="1fyb3x1" data-start="881" data-end="990"><strong data-start="883" data-end="905">Świadczenia zdrowotne:</strong> stypendia na opiekę zdrowotną i pracę w domu wspierające dobre samopoczucie fizyczne i psychiczne.</li> <li data-section-id="1tfbvr9" data-start="991" data-end="1081"><strong data-start="993" data-end="1016">Program urlopowy:</strong> Cztery tygodnie płatnego urlopu naukowego po czterech latach pracy usługi.</li> <li data-section-id="4ci16q" data-start="1082" data-end="1173"><strong data-start="1084" data-end="1102">Elastyczna praca:</strong> elastyczne harmonogramy i hybrydowy model pracy dla naszych zespołów biurowych.</li> <li data-section-id="1ew3lkb" data-start="1174" data-end="1236"><strong data-start="1176" data-end="1196">Posiłki w biurze:</strong> bezpłatne posiłki w naszych centrach biurowych.</li> </ul> <p>Świadczenia mogą się różnić w zależności od lokalizacji, zespołu i roli.</p> <p> </p> <p><em>W Lightning AI dokładamy wszelkich starań, aby wspierać włączające i zróżnicowane miejsce pracy. Wierzymy, że zróżnicowane zespoły napędzają innowacje i tworzą lepsze produkty.
Zapewniamy równe szanse zatrudnienia wszystkim pracownikom i kandydatom bez względu na rasę, kolor skóry, religię, płeć, orientację seksualną, tożsamość płciową, pochodzenie narodowe, wiek, niepełnosprawność, status weterana lub jakąkolwiek inną cechę chronioną. Naszym celem jest budowanie kultury, w której każdy może się rozwijać i wnosić swój pełny potencjał.</em></p></div>Znajdź pracę w Wielkiej Brytanii na Arbeitnow
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.