Technologie
O projekcie
Szukamy DevOps / Site Reliability Engineera, który chce pracować przy dużym, złożonym środowisku produkcyjnym w branży logistycznej — obejmującym transport lądowy, lotniczy i morski.
To rola dla osoby, która dobrze czuje się na styku infrastruktury, Kubernetes, automatyzacji, CI/CD, observability i software engineeringu. Będziesz mieć realny wpływ na niezawodność, wydajność i skalowalność systemów, a także na sposób, w jaki zespoły developerskie budują, wdrażają i utrzymują swoje usługi.
Środowisko jest duże i ma wiele złożonych zależności, dlatego poza pracą z infrastrukturą ważna będzie umiejętność analizowania problemów end-to-end, identyfikowania wąskich gardeł i podejmowania decyzji wpływających na niezawodność całego ekosystemu.
Twoje zadania
- projektowanie, wdrażanie i utrzymanie infrastruktury z wykorzystaniem Terraform,
- przygotowywanie i rozwijanie deploymentów oraz konfiguracji opartych na Helm i Kubernetes,
- utrzymanie i rozwój pipeline’ów GitLab CI/CD,
- automatyzacja wdrożeń, skalowanie infrastruktury oraz innych zadań operacyjnych,
- tworzeniee narzędzi i automatyzacji w Pythonie oraz Go,
- utrzymanie skalowalnej infrastruktury w AWS,
- analiza obecnego stanu systemów i identyfikowanie obszarów wymagających poprawy,
- zwiększanie niezawodności, dostępności i wydajności usług,
- konfiguracja i rozwój monitoringu, dashboardów oraz alertów,
- reagowanie na incydenty, prowadzeniem Root Cause Analysis i wdrażaniem działań zapobiegawczych,
- definiowanie i monitorowanie SLI, SLO i SLA,
- identyfikowanie i eliminowanie wąskich gardeł,
- wsparcie zespołów developerskich w utrzymaniu i wdrażaniu aplikacji,
- rozwijanie i promowanie dobrych praktyk DevOps i SRE.
Wymagania
Szukamy osoby, która:
- ma około 2–3 lat komercyjnego doświadczenia w obszarze SRE oraz doświadczenie związane z DevOps,
- bardzo dobrze zna Kubernetes i rozumie architekturę środowisk klastrowych,
- ma praktyczne doświadczenie z Infrastructure as Code, szczególnie z Terraformem,
- dobrze rozumie procesy CI/CD i potrafi utrzymywać lub rozwijać pipeline’y,
- zna zagadnienia związane z monitoringiem, alertowaniem i observability,
- zna metodykę Root Cause Analysis i potrafi wyciągać konkretne wnioski z incydentów,
- rozumie SLI, SLO i SLA oraz wie, jak wykorzystywać je w praktyce,
- potrafi automatyzować zadania i pisać użyteczny kod lub skrypty,
- zna Python, Go albo jest gotowa/gotowy rozwijać się w tych językach,
- ma doświadczenie we współpracy z zespołami developerskimi,
- potrafi analizować złożone środowiska i proponować rozwiązania zwiększające ich niezawodność,
- interesuje się dobrymi praktykami SRE i DevOps oraz regularnie rozwija swoją wiedzę techniczną.
