Senior Site Reliability Engineer (Azure, Monitoring & Observability)
Tech Stack / Keywords
Firma i stanowisko
W ITLT pomagamy naszym zaprzyjaźnionym firmom przekształcać ambitne pomysły w cyfrową rzeczywistość. Z nastawieniem na wyzwania, ciekawość technologii i zwinność współtworzymy wyjątkowe rozwiązania IT i zapewniamy doświadczone osoby eksperckie, które pomagają przyspieszać cyfrową transformację.
Wymagania
- Min. 5 lat doświadczenia w obszarze Site Reliability Engineering / DevOps / Cloud Engineering (w tym doświadczenie na stanowisku SRE)
- Bardzo dobra znajomość Microsoft Azure oraz doświadczenie w pracy z infrastrukturą produkcyjną
- Praktyczna znajomość Kubernetes, w szczególności Azure Kubernetes Service (AKS)
- Doświadczenie z Kafka, w szczególności Kafka on AKS
- Bardzo dobra znajomość narzędzi Monitoring & Observability, w szczególności Grafana Enterprise / Grafana Cloud, Prometheus, Loki i Thanos
- Doświadczenie w pracy z metrics, logs & traces, tworzeniu dashboardów oraz konfiguracji alertingu
- Dobra znajomość praktyk SRE, w tym incident management, troubleshooting, root cause analysis oraz performance monitoring i optimization
- Doświadczenie z Infrastructure as Code, w szczególności Terraform
- Praktyczna znajomość CI/CD, w szczególności GitHub Actions i/lub Azure DevOps / ADO Pipelines
- Umiejętność automatyzacji z wykorzystaniem Python i Shell scripting
Nice to have:
- Znajomość Databricks
- Doświadczenie z Azure SQL Server
- Znajomość Fivetran
- Znajomość Apache Flink
Obowiązki
- Projektowanie i rozwój platformy Monitoring & Observability dla środowiska Azure/data platform
- Monitoring aplikacji, infrastruktury i Kubernetes/AKS oraz konfiguracja alertingu
- Analiza metryk, logów i trace’ów, troubleshooting oraz root cause analysis
- Budowanie mechanizmów proaktywnego wykrywania problemów i anomalii
- Dbanie o reliability, availability, stability i performance środowisk produkcyjnych
- Automatyzacja procesów operacyjnych oraz rozwój Infrastructure as Code i CI/CD
- Udział w incident management oraz wdrażaniu praktyk Site Reliability Engineering
- Optymalizacja wykorzystania zasobów i kosztów Azure (FinOps)
Benefity
- Długofalowa, stabilna współpraca w oparciu o kontrakt B2B
- Szansa na rozwój w dużej strukturze, bezpośredni kontakt z Managerem zespołu
- Współpraca z ekspertami w firmie, w której IT jest dojrzałe i globalne, a metodyki zwinne są respektowane
- Dopłata do karty MultiSport oraz ubezpieczenia
- Sprawny proces rekrutacyjny (wideokonferencja), maksymalnie 2 spotkania online (pierwsze z kimś z zespołu, drugie z Managerem)
Inne informacje
Informujemy, że administratorem danych jest IT Leasing Team z siedzibą w Warszawie, ul.Taśmowa 7 (dalej jako "administrator"). Masz prawo do żądania dostępu do swoich danych osobowych, ich sprostowania, usunięcia lub ograniczenia przetwarzania, prawo do wniesienia sprzeciwu wobec przetwarzania, a także prawo do przenoszenia danych oraz wniesienia skargi do organu nadzorczego. Dane osobowe przetwarzane będą w celu realizacji procesu rekrutacji. Podanie danych w zakresie wynikającym z ustawy z dnia 26 czerwca 1974 r. Kodeks pracy jest obowiązkowe. W pozostałym zakresie podanie danych jest dobrowolne. Odmowa podania danych obowiązkowych może skutkować brakiem możliwości przeprowadzenia procesu rekrutacji. Administrator przetwarza dane obowiązkowe na podstawie ciążącego na nim obowiązku prawnego, zaś w zakresie danych dodatkowych podstawą przetwarzania jest zgoda. Dane osobowe będą przetwarzane do czasu zakończenia postępowania rekrutacyjnego i przez okres możliwości dochodzenia ewentualnych roszczeń, a w przypadku wyrażenia zgody na udział w przyszłych postępowaniach rekrutacyjnych - do czasu wycofania tej zgody. Zgoda na przetwarzanie danych osobowych może zostać wycofana w dowolnym momencie. Odbiorcą danych jest serwis Just Join IT oraz inne podmioty, którym powierzyliśmy przetwarzanie danych w związku z rekrutacją.
ITLT
132 aktywne oferty