O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
Dostrzegając zalety pracy zdalnej, w tym morale pracowników, produktywność, krótsze dojazdy do pracy, wpływające na dobre samopoczucie pracowników i środowisko, jesteśmy dumni, że jesteśmy firmą stawiającą na technologię cyfrową. Technologie i programy, w które zainwestowaliśmy, zapewniły fantastyczną podstawę do osiągnięcia tego celu. Nasze cyfrowe środowisko pracy, w połączeniu z dogodnie zlokalizowanymi biurami i przestrzeniami do współpracy, zapewniają naszemu zespołowi swobodę i elastyczność pracy w sposób, który zapewnia naszym pracownikom największą produktywność.
O nas Tecsys to szybko rozwijający się innowator oferujący rozwiązania w zakresie łańcucha dostaw dla wiodących w branży systemów opieki zdrowotnej, szpitali i firm farmaceutycznych, dystrybutorom, sprzedawcom detalicznym i 3PL. Współpracujemy z liderami branży, aby przekształcić ich łańcuchy dostaw za pomocą technologii. Jeśli lubisz stawiać czoła interesującym wyzwaniom i masz możliwości ciągłego uczenia się, Tescys może być dla Ciebie odpowiednim rozwiązaniem!
Informacje o roli Poszukujemy inżyniera ds. niezawodności witryny, który dołączy do naszego Centrum operacji sieciowych i bezpieczeństwa (NOC), zespołu zajmującego się niezawodnością platform dla środowisk SaaS o znaczeniu krytycznym. Pomożesz w utrzymaniu, optymalizacji oraz zapewnieniu niezawodności i wydajności systemów obsługujących naszą infrastrukturę chmurową w AWS i Kubernetes, ze szczególnym naciskiem na automatyzację, obserwowalność i ciągłe doskonalenie. Ta rola łączy inżynierię niezawodności z zarządzaniem incydentami, dając Ci rzeczywistą kontrolę nad czasem pracy, wydajnością i innowacjami.
Będziesz częścią wysoko wykwalifikowanego zespołu, który ceni kreatywne rozwiązywanie problemów, doskonałość operacyjną i ciągłe doskonalenie poprzez automatyzację i inżynierię odporności. Obowiązki - Współpraca z zespołami inżynieryjnymi w celu wspierania usług od projektu po uruchomienie, w tym doradztwo w zakresie projektu systemu, planowanie wydajności i przeglądy uruchomień - Utrzymywanie niezawodności usług po wdrożeniu poprzez monitorowanie dostępności, opóźnień i ogólnego stanu systemu - Identyfikowanie słabych punktów i wprowadzanie ciągłych ulepszeń w celu zwiększenia skalowalności, prostoty i odporności platformy - Własna obserwowalność poprzez opracowywanie i ulepszanie monitorowania, ostrzegania, pulpitów nawigacyjnych i definiowanie SLO/SLI (Datadog) - Tworzenie i ulepszanie automatyzacji wewnętrznej narzędzia i struktury IaC (Terraform, CI/CD), aby umożliwić skalowalne i samonaprawiające się systemy - Zrównoważone skalowanie systemów poprzez automatyzację i ulepszenia ukierunkowane na niezawodność - Wykorzystuj narzędzia AI (np. Amazon Kiro) w celu przyspieszenia realizacji podczas sprawdzania wyników - Kieruj reakcją na incydenty, w razie potrzeby pełnij funkcję dowódcy incydentów i prowadź beznaganne badania pośmiertne za pomocą długoterminowych poprawek - Wdrażaj i utrzymuj praktyki rejestrowania, monitorowania, ostrzegania i raportowania SLA - Tworzenie i utrzymywanie technik technicznych dokumentację i wnosić wkład w najlepsze praktyki SRE - Współpracuj z inżynierami platform, zespołami wdrożeniowymi i interesariuszami interdyscyplinarnymi, aby wspierać rozwój i stabilność systemu - Współpracuj z wewnętrznymi zespołami i dostawcami na całym świecie, aby zapewnić wysoką wydajność, dostępność i niezawodność w różnych środowiskach Kwalifikacje wymagań - Duże odpowiednie doświadczenie w zakresie niezawodności witryn, chmury lub inżynierii DevOps w SaaS lub środowiskach produkcyjnych na dużą skalę - Silne doświadczenie z AWS (wiele kont, VPC, EC2, EKS) i Kubernetes na dużą skalę - Praktyczna wiedza z zakresu infrastruktury jako kodu i narzędzi do automatyzacji (Terraform, Ansible lub podobne) - Doświadczenie z potokami CI/CD i automatyzacją wydawania (preferowany GitLab, akceptowalny Jenkins) - Biegłość w narzędziach do monitorowania i obserwowalności (Datadog lub równoważne), w tym metryki, rejestrowanie, ostrzeganie i dashboardy - Doświadczenie w projektowaniu, wdrażaniu i obsłudze wielkoskalowych systemów rozproszonych i platform wielu dostawców - Solidne doświadczenie w zarządzaniu incydentami, w tym rotacją na wezwanie, eskalacje i badania pośmiertne - Silne umiejętności pisania skryptów w języku Python, Bash, Java lub podobnym w celu automatyzacji i diagnostyki - Znajomość narzędzi inżynieryjnych wspomaganych sztuczną inteligencją (np.
Amazon Kiro) i umiejętność skutecznego sprawdzania wyników - Podstawowa znajomość środowisk programistycznych opartych na Javie lub .NET - Proaktywne nastawienie z silnymi nawykami własności, rozwiązywania problemów i dzielenia się wiedzą - Chęć uczestniczenia w dyżurach telefonicznych i okazjonalnych podróżach do biura (mniej niż 10%) Rozumiemy, że doświadczenie ma wiele form i że kariera nie zawsze ma charakter liniowy. Jeśli nie spełniasz wszystkich wymagań zawartych w tym ogłoszeniu, nadal zachęcamy Cię do złożenia wniosku. W Tecsys dokładamy wszelkich starań, aby wspierać zróżnicowane i włączające miejsce pracy, w którym wszyscy pracownicy czują się cenieni, szanowani i wzmocnieni.
Wierzymy, że różnorodność napędza innowacje i wzmacnia naszą zdolność do dostarczania wyjątkowych rozwiązań. Witamy i zachęcamy kandydatów ze wszystkich środowisk, doświadczeń i perspektyw do dołączenia do naszego zespołu. Tecsys jest pracodawcą zapewniającym równe szanse.
Zakwaterowanie jest dostępne dla kandydatów wybranych na rozmowę kwalifikacyjną. Uwaga: jeśli aplikujesz na to stanowisko, musisz być obywatelem Kanady lub stałym rezydentem Kanady LUB posiadać ważne kanadyjskie zezwolenie na pracę. *** Uwaga na temat naszego procesu rekrutacji: Nie używamy sztucznej inteligencji do automatycznego sprawdzania lub odrzucania kandydatów. Używamy jednak szczegółowych pytań kontrolnych, aby nadać priorytet najbardziej odpowiednim aplikacjom do weryfikacji ręcznej.
W Tecsys z radością przyjmujemy przemyślane wykorzystanie narzędzi AI, które pomogą Ci przygotować aplikację, na przykład w celu poprawy przejrzystości, uporządkowania CV lub przećwiczenia odpowiedzi na rozmowy kwalifikacyjne. Prosimy jednak, aby wszystkie podane przez Ciebie informacje odzwierciedlały Twoje rzeczywiste doświadczenia, a wszelkie oceny i pisemne zgłoszenia odzwierciedlały Twoją własną pracę i sposób myślenia. Podczas rozmów kwalifikacyjnych oczekujemy, że kandydaci będą angażować się bez użycia narzędzi AI, skryptów lub pomocy w czasie rzeczywistym.
Autentyczna, bezpośrednia rozmowa pomaga nam poznać sposób, w jaki myślisz, współpracujesz i komunikujesz się. Sztuczna inteligencja może wspierać Twoje przygotowania, ale nie powinna przemawiać ani działać w Twoim imieniu. Naprawdę chcemy Cię poznać.
Aplikuj bezpośrednio na RemoteJobs.org: https://remotejobs.org/remote-jobs/site-reliability-engineer-tecsys-inc
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.