O tym stanowisku
Numery telefonów i adresy e-mail w tym ogłoszeniu są ukryte do momentu zalogowania.
auto_translated_note
O zespole: Platform Infrastructurebuduje, obsługuje i stale rozwija platformę kontenerową i fundamenty chmury FYUL. Promujemy kulturę DevOps poprzez narzędzia samoobsługowe, umożliwiające zespołom inżynierów produktów dostarczanie niezawodnych, bezpiecznych i opłacalnych usług w miarę skalowania firmy. Zespół jest właścicielem naszych kont w chmurze AWS, platformy Kubernetes, sieci w chmurze, stosu obserwowalności, podstawowych baz danych, potoków CI/CD i infrastruktury jako kodu, a także działa jako główny partner dla zespołów inżynieryjnych w zakresie chmur i DevOps.
O roli: Zatrudniamy starszego specjalistę SRE II, który dołączy do Platform Infrastructure jako jeden ze starszych indywidualnych współpracowników zespołu. Na tym poziomie jesteś osobą, do której możesz się zwrócić w przypadku najbardziej złożonych problemów z infrastrukturą: tworzysz i realizujesz wielkoskalowe inicjatywy w zakresie automatyzacji i niezawodności, wyznaczasz standardy, którymi podążają inni inżynierowie, oraz jesteś mentorem dla SRE na poziomie stowarzyszonym i średniego szczebla. Będziesz dzielić swój czas pomiędzy praktyczną pracę na platformie - Kubernetes, AWS, GCP, CI/CD, obserwowalność - i przywództwo techniczne: proponowanie projektów, przeglądanie pracy innych i pomaganie zespołowi w dokonaniu dobrego kompromisu między budową a zakupem oraz kosztem i niezawodnością.
Twoje codzienne zadania będą obejmować: - Infrastrukturę i niezawodność: Projektowanie i zarządzanie wysoce dostępną, bezpieczną i skalowalną infrastrukturą na wielu kontach i środowiskach AWS przy użyciu infrastruktury jako kodu. - Projektuj i obsługuj nasze klastry Amazon EKS, w tym zasady sieciowe, trwałe przechowywanie i strategie skalowania dla obciążeń kontenerowych. - Posiadaj i rozwijaj podstawowe usługi platformy: sieci w chmurze, Kubernetes oraz bazy danych i zespoły inżynierów systemów przesyłania wiadomości, na których polegają. - Automatyzacja i infrastruktura jako kod: prowadź projekty automatyzacji na dużą skalę i wyznaczaj standardy korzystania z Terraform / Terragrunt i GitOps (ArgoCD) w zespołach. - Kieruj wdrażaniem automatyzacji, aby ograniczyć ręczną pracę operacyjną i zapewnić spójność i powtarzalność środowisk. - Obserwacja i reakcja na incydenty: Bądź osobą, do której możesz się udać w rozwiązywaniu złożonych problemów z infrastrukturą obejmującą wiele usług. - Prowadź inicjatywy poprawiające niezawodność i obserwowalność (Grafana, Prometheus, Loki, Tempo, Mimir), aby systemy skalowały się przy minimalnej interwencji ręcznej. - Uczestnictwo w rotacji na wezwanie, kierowanie reakcją na incydenty związane z problemami produkcyjnymi oraz pisanie przejrzystych książeczek wykonawczych, ADR i sekcji zwłok. - Bezpieczeństwo i efektywność kosztowa: Kieruj działaniami w zakresie bezpieczeństwa w zespole - IAM, szyfrowanie, bezpieczne logowanie - i doradzaj innym w zakresie praktyk związanych z bezpieczną infrastrukturą. - Regularnie kontroluj wydatki na infrastrukturę i optymalizuj koszty na całej platformie (rightsizing, autoskalowanie, praktyki FinOps). - Współpraca i mentoring: Mentoruj SRE średniego szczebla, przekazuj szczegółowe informacje zwrotne i wspieraj wdrażanie nowych członków zespołu. - Przekazuj złożone koncepcje techniczne w jasny sposób zarówno inżynierom, jak i interesariuszom nietechnicznym. - Współpracuj z zespołami inżynierów produktów, aby zrozumieć ich potrzeby i reprezentować infrastrukturę platformy w inicjatywach międzyzespołowych. Twoje kwalifikacje: Odzwierciedlają one poziom techniczny, który utrzymujemy wewnętrznie dla Senior SRE II, w oparciu o nasze ramy kompetencji SRE i aktualny stos. - Podstawowe doświadczenie techniczne: - Solidna administracja systemami Linux i wygodne pisanie skryptów w Pythonie. - Dobra znajomość AWS: EKS, IAM (role, zasady, IRSA), sieci VPC, RDS, S3, SQS oraz znajomość Well-Architected Framework; doświadczenie w wielokontowych środowiskach AWS będzie mocnym plusem. - Praktyczne doświadczenie w obsłudze Kubernetes (EKS) i rozwiązywaniu problemów na skalę produkcyjną, w tym opracowywanie wykresów Helm, tworzenie sieci CNI (uruchamiamy Cilium), koncepcje sieci pod/IPAM i bezpieczeństwo kontenerów (ECR, skanowanie obrazu). - Biegła znajomość Terraform (moduły, zarządzanie stanem) i najlepiej Terragrunt do zarządzania wieloma środowiskami; Doświadczenie GitOps z ArgoCD. - Doświadczenie z Postgres, MySQL i/lub MongoDB w skali produkcyjnej, w tym Aurora. - Doświadczenie CI/CD z Jenkins (Jenkinsfile, biblioteki współdzielone) i/lub GitHub Actions oraz znajomość strategii wdrożeniowych, takich jak blue-green i canary. - Doświadczenie ze stosem obserwowalności Grafana (Grafana, Prometheus, Loki, Tempo, Mimir) - projektowanie metryk, dashboardy, alerty, agregacja logów i śledzenie rozproszone. Nie tylko używać, ale także utrzymywać. - Praktyczne doświadczenie w zarządzaniu incydentami: rotacje na wezwanie, ustrukturyzowane reagowanie na incydenty i pisanie runbooków/postmortemów. - Praktyczna znajomość zasad aplikacji 12-Factor i optymalizacji kosztów / świadomość FinOps.
2.Jak pracujesz: - Metodyczne podejście do rozwiązywania problemów w oparciu o dane, a nie zgadywanie. - Silna komunikacja pisemna - piszesz księgi runbooków, ADR i sekcje zwłok, z których inni mogą skorzystać. - Komfortowe inicjatywy w zakresie prowadzenia inicjatyw z niejednoznaczną własnością i branie odpowiedzialności za wyniki, zamiast czekać, aż zostaniesz o to poproszony. - Doświadczenia w zakresie mentoringu dla inżynierów niższego szczebla i przekazywania bezpośrednich, konstruktywnych informacji zwrotnych. - Kilka lat praktycznego doświadczenia w infrastrukturze produkcyjnej/SRE, z wykazaną współpracą z inicjatywami na poziomie indywidualnego kontrybutora wyższego szczebla (kierowanie pracami projektowymi, ustalanie standardów, bycie punktem eskalacji trudnych problemów). 3. Miło jest mieć: - Doświadczenie GCP. - Doświadczenie z Kafką/AWS MSK. - Wcześniejsze doświadczenie w środowiskach regulowanych lub wrażliwych na zgodność (najlepsze praktyki w zakresie bezpieczeństwa, przeglądy dostępu). - Doświadczenie w tworzeniu planu działania platformy/DevEx, który inne zespoły inżynieryjne wykorzystują jako produkt samoobsługowy.
Nasz stos technologiczny: - Języki: PHP (Symfony), Node.js (TypeScript), Angular (TypeScript). - Dane: PostgreSQL, Redis, MongoDB. - Infra: AWS, Kubernetes, Terraform, Helm, Atlantis - Narzędzia inżynieryjne: Postman, Git, GitHub Copilot, PhpStorm, Grafana, Kibana, Prometheus. - Narzędzia do pracy zdalnej: Jira, Miro, Google Workspace, Slack. - Praktyki programistyczne: programowanie w parach, przeglądy kodu, ciągła integracja/wdrażanie. Co oferujemy: - Globalny, włączający zespół, który wspiera, a jednocześnie ambitnie i poważnie podchodzi do realizacji zadań - Możliwość pracy zdalnej lub w nowoczesnym i przyjaznym biurze w Rydze - Elastyczne godziny pracy (rozpocznij dzień dopiero o 11:00) - Prywatne ubezpieczenie zdrowotne - 2 dodatkowe płatne dni wolne, aby skupić się na swoim dobrym samopoczuciu psychicznym lub fizycznym - 1 dodatkowy płatny dzień wolny z okazji urodzin lub innej wybranej przez Ciebie uroczystości - Możliwości uczenia się wewnętrznego i zewnętrznego - Dostęp do mentoringu, wewnętrznych spotkań i hackathony, zarówno na miejscu, jak i online - Bezpłatny i zdrowy lunch, jeśli pracujesz w biurze w Rydze - Zaprojektuj i zamów własne gadżety za pomocą naszych platform ze zniżką dla pracowników - Ekscytujące wydarzenia i imprezy integracyjne, których nigdy nie zapomnisz! FYUL to silnik obsługujący handel na żądanie w skali globalnej.
Utworzona w 2024 roku w wyniku fuzji Printful, Printify i Snow Commerce, łączymy technologię, talenty i infrastrukturę, aby pomóc ludziom przekształcać pomysły w piękne produkty. Od twórców indywidualnych po gigantów branży rozrywkowej - FYUL oferuje produkty, które docierają do milionów, dzięki zaawansowanej technologii, produkcji premium i globalnemu zasięgowi. Jesteśmy szybko rozwijającą się globalną firmą, której celem jest wspieranie wspaniałych marek, wspaniałych doświadczeń i wspaniałych ludzi.
Jesteśmy miejscem pracy zapewniającym równe szanse. Zależy nam na różnorodności i włączeniu, dlatego decyzje o zatrudnieniu podejmujemy wyłącznie w oparciu o kwalifikacje, zasługi i doświadczenie zawodowe. Jeśli uważasz, że sprawdzisz się na tym stanowisku, prześlij nam swoje CV w języku angielskim, pokazując, dlaczego jesteś odpowiednią osobą na to stanowisko.
Interesuje Cię, ale uważasz, że to nie jest dla Ciebie odpowiednie rozwiązanie? Podziel się nim ze znajomymi i sprawdź inne wolne stanowiska na naszej stronie poświęconej karierom. Zawsze poszukujemy kreatywnych i zdeterminowanych umysłów, które dołączyłyby do naszego stale rosnącego zespołu!
AS Printful Łotwa (Reģ. Nr. 40*** *** 078) Aplikuj bezpośrednio na RemoteJobs.org: https://remotejobs.org/remote-jobs/senior-site-reliability-engineer-remote-within-emea-fyul
Pytania spolecznosci
Ktos tu pracowal? Zapytaj przed aplikacja.
Brak watkow dla tej oferty lub firmy.