Kogo szukamy?
posiadasz minimum 3 lata doświadczenia w obszarze DevOps/SRE
swobodnie poruszasz się w Google Cloud Platform oraz środowiskach produkcyjnych opartych o chmurę publiczną (GCP lub inną, z otwartością na rozwój w kierunku GCP);
wykorzystujesz Terraform do zarządzania infrastrukturą w podejściu Infrastructure as Code;
znasz Kubernetes oraz podstawy podejścia GitOps, w szczególności narzędzia takie jak Flux, Kustomize lub ArgoCD;
dobrze odnajdujesz się w obszarze CI/CD i potrafisz tworzyć reużywalne pipeline'y;
potrafisz budować rozwiązania z zakresu observability z wykorzystaniem Prometheus, Grafany lub podobnych narzędzi;
rozumiesz zagadnienia związane z zarządzaniem sekretami (Vault lub rozwiązania pokrewne) oraz bezpieczeństwem procesów CI/CD;
interesują Cię praktyki SRE, takie jak SLI/SLO, error budgety czy postmortemy, a także dalszy rozwój kompetencji w tym obszarze.
Mile widziane:
znajomość GitLab CI;
podstawowa znajomość języka Go;
doświadczenie w tworzeniu narzędzi i automatyzacji wspierających procesy infrastrukturalne;
znajomość rozwiązań z obszaru service mesh oraz API Gateway;
doświadczenie związane z narzędziami i platformami wykorzystywanymi w obszarze data engineering.
Co będzie należało do Twoich zadań?
rozwój i utrzymanie infrastruktury w Google Cloud Platform z wykorzystaniem podejścia Infrastructure as Code (Terraform);
zarządzanie klastrami Kubernetes w modelu GitOps z wykorzystaniem narzędzi takich jak Flux i Kustomize;
wsparcie wdrożeń progresywnych (canary releases) oraz rozwój wewnętrznych narzędzi wspierających procesy CI/CD, głównie w technologii Go;
utrzymanie i rozwój pipeline'ów GitLab CI obejmujących Terraform, Kubernetes/GitOps oraz budowę i skanowanie obrazów kontenerowych;
rozwój i doskonalenie warstwy platformowej, w tym rozwiązań service mesh i API gateway wspierających komunikację pomiędzy usługami;
zarządzanie dostępami i sekretami z wykorzystaniem HashiCorp Vault zgodnie z zasadą najmniejszych uprawnień;
rozwój rozwiązań observability opartych o Prometheus i Grafanę oraz optymalizację jakości alertingu;
wspieranie praktyk Site Reliability Engineering (SRE), w tym obszarów SLI/SLO, error budget’ów oraz analiz postmortem;
zapewnianie bezpieczeństwa pipeline'ów oraz obrazów kontenerowych zgodnie z dobrymi praktykami DevSecOps;
współpracę z zespołami produktowymi oraz data engineering w zakresie projektowania i wdrażania rozwiązań odpowiadających na potrzeby biznesowe i technologiczne.