O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
## Informacje o Dysrupit DysrupIT jest firmą technologiczną prowadzoną przez doradztwo. Pomagamy przedsiębiorstwom średniej wielkości i przedsiębiorstwom rozwiązywać problemy biznesowe za pomocą technologii - niezależnie od tego, czy jest to doradztwo, realizacja, usługi zarządzane czy zwiększanie personelu - i bierzemy odpowiedzialność za wynik. Zależy nam na wywieraniu pozytywnego wpływu na społeczności, którym służymy. ## Kultura firmy W DysrupIT sukces nie jest mierzony liczbą zatrudnionych pracowników ani rozliczonymi godzinami - mierzony jest uzyskanymi wynikami.
Jesteśmy zespołem, który przejmuje odpowiedzialność za pracę, jest ciekawy problemów wykraczających poza nasz bezpośredni zasięg i buduje relacje, które mają się rozwijać, a nie tylko odnawiać lub kończyć. Inwestujemy w naszych pracowników, zapewniając im szkolenia i wsparcie, których potrzebują, aby rozwijać swoją karierę, i wspieramy kulturę, w której każdego, niezależnie od roli, zachęca się do dostrzegania możliwości, zadawania jeszcze jednego pytania i pomagania w przedstawianiu historii naszym klientom, a nie tylko jej dostarczania. ## Streszczenie stanowiska Inżynier ds. infrastruktury i operacji na platformach wspiera, utrzymuje i ulepsza infrastrukturę i platformy produkcyjne wykorzystywane do świadczenia usług Nephos klientom. Osoba na tym stanowisku pracuje w infrastrukturze chmurowej/lokalnej, Linux, sieci, bazach danych, kontenerach, monitorowaniu i platformach korporacyjnych, ze szczególnym naciskiem początkowo na wsparcie produkcyjne BAU, stabilność usług i transfer wiedzy.
W miarę rozwoju możliwości rola ta będzie również przyczyniać się do zmiany platformy, modernizacji, automatyzacji i realizacji projektów. ## Obowiązki na stanowisku Godziny pracy: 9 - 5 godzin w Wielkiej Brytanii podczas wdrażania i przejścia, z możliwością sporadycznych aktualizacji, zmian i poważnych incydentów poza godzinami pracy. - Pracuj w ramach Service Operations w celu wspierania infrastruktury przedsiębiorstwa i platform produkcyjnych, w tym monitorowania stanu, rozwiązywania problemów, proaktywnej konserwacji, odporności i ciągłego doskonalenia. - Administrowanie, wsparcie i rozwiązywanie problemów środowiskami klientów, w tym infrastrukturą podstawową, pamięcią masową, siecią, świadomością IAM, zasobami obliczeniowymi i usługami zarządzanymi istotnymi dla obsługiwanych platform. - Obsługa środowisk Linux, głównie Ubuntu i Red Hat, przy użyciu administracji z wiersza poleceń i technik rozwiązywania problemów; w razie potrzeby zapewnij odpowiednią pomoc techniczną dla systemu Windows. - Diagnozuj złożone problemy z siecią i łącznością w protokole TCP/IP, DNS, routingu, zaporach ogniowych, VPN, TLS, serwerach proxy, modułach równoważenia obciążenia i sieciach w chmurze. - Administrowanie i wsparcie środowiskami produkcyjnymi PostgreSQL, w tym konfiguracja, role i uprawnienia, monitorowanie, tworzenie kopii zapasowych i przywracanie, odzyskiwanie, badanie wydajności i aktualizacje. - Administrowanie i wspieranie środowisk produkcyjnych MongoDB, w tym stan, dzienniki, wydajność, tworzenie kopii zapasowych i odzyskiwanie, aktualizacje i rozwiązywanie problemów. - Obsługa kontenerowych i zorganizowanych środowisk przy użyciu Dockera i Kubernetesa, w tym cykl życia kontenera, dzienniki, konfiguracja, woluminy, sieć, rejestry, kontrole stanu, ograniczenia zasobów i diagnostyka awarii. - Wsparcie usług i klastrów kontenerów w chmurze, w tym AWS z EKS i ECS, jeśli ma to zastosowanie, oraz udział w konfiguracji platformy, zarządzaniu stanem i pojemnością. - Monitoruj infrastrukturę i aplikacje za pomocą narzędzi do monitorowania i obserwowalności przedsiębiorstwa, w tym badania alertów, analizy logów, przeglądu progów, identyfikacji głównych przyczyn i redukcji niepotrzebnego szumu alertów. - Używaj skryptów i automatyzacji, szczególnie Python i PowerShell, aby poprawić powtarzalność, zmniejszyć wysiłek ręczny i wspierać zadania operacyjne; Cenne jest również doświadczenie Bash lub inne możliwe do przeniesienia doświadczenie w pisaniu skryptów. - Używaj Git i GitHub do zarządzania skryptami, konfiguracją i treścią operacyjną, zgodnie z odpowiednimi praktykami kontroli wersji. - Wsparcie instalacji, konfiguracji, aktualizacji, testowania, sprawdzania poprawności i odzyskiwania platform korporacyjnych, w tym platform danych, takich jak BigID i rozwiązań opracowanych wewnętrznie, takich jak platformy opracowane przez Nephos, do których dostęp klienta jest zatwierdzony. - Szybko ucz się i rozwijaj możliwości operacyjne na nowych lub nieznanych platformach korporacyjnych, korzystając ze strukturalnego transferu wiedzy, dokumentacji, praktycznego śledzenia i niezależnej realizacji zadań. - Przejmuj na własność rejestry incydentów i problemów, stosując uporządkowane rozwiązywanie problemów w celu identyfikacji problemów, przywracania usług tak szybko i bezpiecznie, jak to możliwe, przeprowadzaj analizę przyczyn źródłowych i prowadź dokładne rejestry. - Przejmuj odpowiedzialność za zgłoszenia serwisowe i techniczne zadania operacyjne, zapewniając, że prace zostaną wykonane dokładnie, bezpiecznie i zgodnie z ustalonymi priorytetami. - Zarządzanie dokumentacją zmian związaną z infrastrukturą, bazami danych, platformami, aktualizacjami i działaniami usprawniającymi, uczestnictwo w CAB tam, gdzie jest to wymagane i zapewnianie, że plany wdrożenia, walidacji i wycofywania zmian są odpowiednie. - Twórz i utrzymuj przejrzyste artykuły merytoryczne, podręczniki i instrukcje pracy oraz aktywnie uczestnicz w szkoleniach przekrojowych, aby kluczowa wiedza operacyjna nie była skoncentrowana na jednej osobie. - Współpracuj bezpośrednio z klientami i wewnętrznymi zespołami technicznymi podczas incydentów, zmian, ulepszeń i dochodzeń, jasno wyjaśniając ustalenia i zachowując profesjonalne podejście skupione na kliencie. - Współpraca z DevOps, Data Services, Product, Delivery i innymi zespołami interdyscyplinarnymi w celu rozwiązywania problemów i dostarczania kompleksowych wyników platformy. - Wkład techniczny w ulepszenia platformy, jej odporność, pojemność, monitorowanie i projekt operacyjny. Ostateczne decyzje dotyczące architektury i zarządzania pozostają w ramach wspólnych obowiązków wewnętrznych. - Wsparcie działań związanych z tworzeniem kopii zapasowych, przywracaniem i odzyskiwaniem po awarii, w tym praktycznymi ćwiczeniami w zakresie sprawdzania poprawności i odzyskiwania. - Pracuj zgodnie z zasadami bezpieczeństwa, w tym najniższymi uprawnieniami, bezpieczną obsługą poświadczeń, tajemnicami, certyfikatami, możliwością audytu, łataniem i świadomością luk w zabezpieczeniach. - Dostęp do poszczególnych środowisk klientów nadal podlega odpowiednim procesom umownym klienta, bezpieczeństwu i zatwierdzaniu dostępu. - Rola koncentruje się na obsłudze, wspieraniu, wdrażaniu i ulepszaniu platform produkcyjnych, a nie na rozwijaniu funkcjonalności aplikacji. ## Kwalifikacje - zazwyczaj ponad 5 lat doświadczenia w inżynierii infrastruktury, obsłudze platform, inżynierii systemów lub wsparciu produkcji; Możliwa do wykazania zdolność jest ważniejsza niż ustalona liczba lat. - Silne, praktyczne doświadczenie w zakresie BAU i wsparcia produkcyjnego, w tym własność incydentów na żywo, przywracanie usług, monitorowanie, nieudane zmiany lub wdrożenia, analiza przyczyn źródłowych i kontrolowane działania naprawcze. - Silne, praktyczne doświadczenie AWS w środowiskach produkcyjnych. Podstawowym wymaganiem w chmurze dla tej roli jest AWS. - Bardzo mocne, możliwe do udowodnienia doświadczenie w administrowaniu Linuksem i rozwiązywaniu problemów, szczególnie Ubuntu i Red Hat, w tym pewne korzystanie z wiersza poleceń. - Głębokie, praktyczne doświadczenie w rozwiązywaniu problemów z siecią i łącznością, obejmujące TCP/IP, DNS, routing, zapory ogniowe, VPN, TLS i sieci w chmurze. - Silne doświadczenie w administrowaniu MongoDB i rozwiązywaniu problemów produkcyjnych.
Jest to kluczowa umiejętność w przypadku tej roli. - Znaczące doświadczenie operacyjne PostgreSQL, w tym administracja, tworzenie kopii zapasowych i odzyskiwanie, monitorowanie i rozwiązywanie problemów; Doświadczenie DBA w głębszej produkcji jest wysoko cenione. - Praktyczne doświadczenie produkcyjne z Dockerem i solidna praktyczna wiedza na temat cyklu życia kontenera, sieci, rejestrowania, stanu zdrowia i rozwiązywania problemów. - Solidne, praktyczne doświadczenie w Kubernetes, w tym stan wdrożenia, pody, usługi, konfiguracja, dzienniki i diagnostyka awarii. - Doświadczenie we wspieraniu aplikacji i platform dla przedsiębiorstw poprzez instalację, konfigurację, aktualizacje wersji, monitorowanie stanu i rozwiązywanie problemów technicznych. - Silne możliwości tworzenia skryptów i automatyzacji, szczególnie Python i/lub PowerShell; istotne jest również doświadczenie z Bashem lub innymi możliwymi do przeniesienia językami skryptowymi. - Solidne podstawy monitorowania i obserwowalności, w tym wskaźniki infrastruktury, badanie dzienników, analiza alertów i odróżnianie symptomów od pierwotnej przyczyny. - Doskonała umiejętność analizy problemów, rozwiązywania problemów i wyszukiwania usterek, przy metodycznym podejściu do złożonych problemów produkcyjnych. - Praktyczna znajomość Git i GitHub, w tym repozytoriów, kontroli wersji i praktyk współpracy. - Praktyczne zrozumienie zasad tworzenia kopii zapasowych, przywracania, odzyskiwania i odporności usług. - Praktyczne doświadczenie w zarządzaniu usługami IT obejmującymi procesy incydentów, problemów, zmian, zgłoszeń serwisowych i poważnych incydentów. Formalna certyfikacja ITIL nie jest obowiązkowa. - Doświadczenie w korzystaniu z platformy zarządzania usługami, takiej jak Jira/JSM, ServiceNow, Remedy, Freshservice lub równoważnej. - Dobra świadomość bezpieczeństwa, w tym najmniejsze uprawnienia, koncepcje uprawnień, klucze tajne, certyfikaty, MFA, dostęp uprzywilejowany, instalowanie poprawek, świadomość luk w zabezpieczeniach i bezpieczna obsługa poświadczeń. - Silne podejście skoncentrowane na kliencie z możliwością jasnej komunikacji z interesariuszami technicznymi i nietechnicznymi podczas normalnych operacji i incydentów. - Doskonałe umiejętności komunikacji pisemnej i ustnej, w tym umiejętność tworzenia przejrzystej dokumentacji technicznej i procedur operacyjnych. - Możliwość wykazania się zdolnością do uczenia się złożonej, nieznanej technologii i osiągania niezależnej efektywności po zorganizowanym onboardingu i transferze wiedzy. - Możliwość samodzielnej pracy po onboardingu, zarządzania wieloma priorytetami i rozpoznawania, kiedy wymagana jest eskalacja lub szerszy wkład techniczny. - Elastyczny, zorganizowany i zmotywowany, z chęcią uczestniczenia okazjonalnie w aktualizacjach, zmianach i poważnych incydentach poza godzinami pracy, jeśli jest to wymagane. ## Miło to mieć - praktyczne doświadczenie z platformą Azure. Oczekuje się, że platforma Azure będzie zyskiwać coraz większe znaczenie, chociaż AWS pozostaje głównym obecnym wymaganiem. - Doświadczenie z Google Cloud Platform i usługami takimi jak Cloud Run lub Cloud SQL. - Doświadczenie w zakresie zasad i narzędzi infrastruktury jako kodu, takich jak Terraform, CloudFormation, Ansible lub równoważnych. - Znajomość platform CI/CD i potoków wdrażania, takich jak GitHub Actions, Jenkins, GitLab CI lub Azure DevOps. - Wcześniejsze doświadczenie z BigID lub inną złożoną platformą zarządzania danymi w przedsiębiorstwie.
Doświadczenie w BigID nie jest wymagane, ale ważna jest umiejętność jego nauczenia. - Doświadczenie z RabbitMQ, Redis lub podobnymi technologiami przesyłania wiadomości/pamięci podręcznej. - Doświadczenie z LogicMonitor lub porównywalnymi platformami monitorowania dla przedsiębiorstw. - Doświadczenie w korzystaniu z technologii dostępu uprzywilejowanego i zarządzania tajemnicami, takich jak narzędzia Delinea i HashiCorp. - Doświadczenie w zakresie interfejsów API REST i rozwiązywania problemów z interfejsami API. - Doświadczenie w stosowaniu, odnawianiu i rozwiązywaniu problemów z certyfikatami TLS. - Doświadczenie w planowaniu odzyskiwania po awarii, rozważaniach RPO/RTO i praktycznych testach odzyskiwania. - Znajomość zarządzania danymi, bezpieczeństwa informacji lub regulowanych środowisk klientów. - Odpowiednie certyfikaty AWS, Azure, Kubernetes, PostgreSQL, MongoDB lub ITIL. Certyfikaty są zaletą, ale nie są obowiązkowe. - Doświadczenie we wspieraniu mikroserwisów, architektur platform bezserwerowych lub rozproszonych. ## Co oferujemy - konkurencyjny pakiet wynagrodzeń proporcjonalny do doświadczenia. - Świadczenia gwarantowane przez rząd oraz dodatkowe ubezpieczenie HMO. - Współpracę i profesjonalne środowisko pracy. - Możliwości rozwoju kariery w rozwijającej się organizacji technologicznej. - Organizacja pracy hybrydowej/zdalnej (w stosownych przypadkach). Aplikuj bezpośrednio na RemoteJobs.org: https://remotejobs.org/remote-jobs/infrastructure-platform-operatives-engineer-dysrupit
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.