Inżynier infrastruktury HPC
Australia, Canada, France, Germany, India, United Kingdom, United States
Do uzgodnienia
O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
Insight Softmax jest wiodącą organizacją w dziedzinie uczenia maszynowego, analityki danych i obliczeń o wysokiej wydajności (HPC). Naszym celem jest dostarczanie innowacyjnych rozwiązań w technologii komputerowej w celu rozwiązywania złożonych problemów w różnych sektorach, w tym w badaniach, nauce, produkcji, finansach i analizie danych. Opis: Zatrudniamy inżyniera infrastruktury HPC do naszego zespołu inżynierów.
W obszarze HPC projektujemy i budujemy usługi CFD (obliczeniowa dynamika płynów) oraz symulacje. Idealny kandydat będzie miał duże doświadczenie w budowaniu i utrzymywaniu usług obliczeniowych o wysokiej wydajności, wiedzę specjalistyczną w zakresie systemów rozproszonych oraz pasję do inżynierii systemów, skalowania i architektury pamięci masowej. Ta rola obejmuje ścisłą współpracę z naszymi zespołami programistów w celu projektowania, wdrażania i optymalizacji rozwiązań HPC, które spełniają nasze rosnące potrzeby.
Ta szansa jest szczególnie wyjątkowa, dostępna w naszym zespole skunkworks w Insight Softmax. Chociaż dokładny charakter i cel tej pracy są poufne, jest to niezwykle ekscytujący zestaw projektów i celów, które dotyczą torów pływackich HPC, ML, Simulation i Quantum. Nasz zespół HPC tworzy usługi i architekturę CFD, która będzie integrować się bezpośrednio z usługami ML i symulacji.
Na tych torach będziesz kontaktować się i współpracować z najbardziej doświadczonymi i utalentowanymi ludźmi na świecie. Zespół ds. infrastruktury, który tworzymy, wymaga osób skupiających się na dostawach i wynikach, głodnych nauki, zdolności do adaptacji, a także prosperujących w środowisku, w którym nie zapewni się wszystkich szkoleń ani instrukcji niezbędnych do realizacji celów. Otrzymasz najwyższe cele inżynieryjne i kamienie milowe, więc będziesz odpowiedzialny za określenie i dostarczenie tego, co jest wymagane, aby je osiągnąć.
Osoby z doświadczeniem w start-upach mogą czuć się bardziej komfortowo na tej pozycji, podobnie jak osoby, które odczuwają swędzenie psychiczne, którego nigdy nie da się całkowicie zadrapać. Chociaż osoby na wyższym szczeblu często wnoszą do zespołu bardzo potrzebne doświadczenie, zawsze jesteśmy otwarci na osoby mniej doświadczone, które mogą posiadać świetne cechy pasujące do kultury naszego zespołu. W zależności od celów inżynieryjnych, priorytetów i umiejętności członków zespołu, w przyszłości możemy zmieniać obowiązki członków zespołu lub połączyć siły, aby szybciej ukończyć jeden projekt, dzięki czemu będziesz mieć możliwość pracy nad innymi projektami (ML, symulacja, kwantowa itp.) poza HPC.
Kluczowe obowiązki: Projektowanie, budowanie i utrzymywanie infrastruktury obliczeniowej o wysokiej wydajności (HPC). Rozwijaj i wdrażaj skalowalne systemy rozproszone do złożonych zadań obliczeniowych. Skalowanie usług i systemów z mniejszych wdrożeń obejmujących ~50 węzłów do większych klastrów ~250+ węzłów.
Korzystanie z orkiestracji, zarządzanie konfiguracją, wirtualizacja, Linux, CLI, wdrażanie narzędzi, monitorowanie, APM. Monitoruj wydajność systemów HPC i wdrażaj ulepszenia, aby zapewnić skalowalność i wydajność. Optymalizacja inżynierii i wyników w celu zrównoważenia rozwoju funkcji, jakości produktu i niezawodności usług.
Kwalifikacje: Co najmniej 3-5 lat doświadczenia w infrastrukturze HPC, inżynierii systemów lub na podobnym stanowisku. Silne zrozumienie zasad inżynierii systemów i strategii skalowania. Dogłębna znajomość co najmniej jednego z AWS, GCP lub Azure.
Najlepiej AWS-a. Mocne kotlety linuksowe. Doświadczenie w architekturze danych i przetwarzaniu danych na dużą skalę.
Opcjonalne doświadczenie i umiejętności: doświadczenie w zakresie CFD HPC. Skalowanie usług i systemów z klastrów obejmujących jeden region do wdrożeń wieloregionalnych. Doświadczenie z klastrami większymi niż 100 węzłów.
Tworzenie systemów lokalnych (lokalnych, w centrach danych, typu rack-n-stack itp.). Dystrybucja obciążeń zarówno na systemy w chmurze, jak i lokalne. Równoważenie potrzeb biznesowych, terminów dostaw produktów i zadowolenia klientów.
Dodatkowe doświadczenie i umiejętności: Backend działa jak SQL, tworzenie API i bezserwerowo. Inżynieria oprogramowania Python i/lub inne języki programowania Wykorzystywanie kreatywności, generowanie innowacyjnych produktów i funkcji oraz zapewnianie wspaniałego doświadczenia klienta. Używanie systemu Linux jako podstawowego środowiska stacji roboczej.
Cechy, które cenimy: Przejrzystość Zaangażowanie Skuteczność Chęć do nauki Lokalizacja i godziny pracy: Praca w niepełnym wymiarze godzin (godziny różnią się w zależności od potrzeb projektu) Środowisko pracy zdalnej 80% Twojego harmonogramu pracy będzie przypadać na biznesowe strefy czasowe Ameryki Łacińskiej i Kanady. Niektóre spotkania z klientami będą odbywać się co tydzień w niestandardowych godzinach/nocnych, ponieważ obecnie wspieramy globalny zespół na 3-4 kontynentach. Referencje: wymagane będą 3 referencje.
Pierwotnie opublikowane w Himalajach
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.