ITLT
ITLT
New

Senior Site Reliability Engineer (Azure, Monitoring & Observability)

Brak informacji o wynagrodzeniu
SeniorFull-time·B2B
#405984·Dodano 5 dni temu·2
Źródło: ITLT
Aplikuj teraz

Tech Stack / Keywords

AzureKubernetesCI/CD

Firma i stanowisko

W ITLT pomagamy naszym zaprzyjaźnionym firmom przekształcać ambitne pomysły w cyfrową rzeczywistość. Z nastawieniem na wyzwania, ciekawość technologii i zwinność współtworzymy wyjątkowe rozwiązania IT i zapewniamy doświadczone osoby eksperckie, które pomagają przyspieszać cyfrową transformację.

Wymagania

  • Min. 5 lat doświadczenia w obszarze Site Reliability Engineering / DevOps / Cloud Engineering (w tym doświadczenie na stanowisku SRE)
  • Bardzo dobra znajomość Microsoft Azure oraz doświadczenie w pracy z infrastrukturą produkcyjną
  • Praktyczna znajomość Kubernetes, w szczególności Azure Kubernetes Service (AKS)
  • Doświadczenie z Kafka, w szczególności Kafka on AKS
  • Bardzo dobra znajomość narzędzi Monitoring & Observability, w szczególności Grafana Enterprise / Grafana Cloud, Prometheus, Loki i Thanos
  • Doświadczenie w pracy z metrics, logs & traces, tworzeniu dashboardów oraz konfiguracji alertingu
  • Dobra znajomość praktyk SRE, w tym incident management, troubleshooting, root cause analysis oraz performance monitoring i optimization
  • Doświadczenie z Infrastructure as Code, w szczególności Terraform
  • Praktyczna znajomość CI/CD, w szczególności GitHub Actions i/lub Azure DevOps / ADO Pipelines
  • Umiejętność automatyzacji z wykorzystaniem Python i Shell scripting

Nice to have:

  • Znajomość Databricks
  • Doświadczenie z Azure SQL Server
  • Znajomość Fivetran
  • Znajomość Apache Flink

Obowiązki

  • Projektowanie i rozwój platformy Monitoring & Observability dla środowiska Azure/data platform
  • Monitoring aplikacji, infrastruktury i Kubernetes/AKS oraz konfiguracja alertingu
  • Analiza metryk, logów i trace’ów, troubleshooting oraz root cause analysis
  • Budowanie mechanizmów proaktywnego wykrywania problemów i anomalii
  • Dbanie o reliability, availability, stability i performance środowisk produkcyjnych
  • Automatyzacja procesów operacyjnych oraz rozwój Infrastructure as Code i CI/CD
  • Udział w incident management oraz wdrażaniu praktyk Site Reliability Engineering
  • Optymalizacja wykorzystania zasobów i kosztów Azure (FinOps)

Benefity

  • Długofalowa, stabilna współpraca w oparciu o kontrakt B2B
  • Szansa na rozwój w dużej strukturze, bezpośredni kontakt z Managerem zespołu
  • Współpraca z ekspertami w firmie, w której IT jest dojrzałe i globalne, a metodyki zwinne są respektowane
  • Dopłata do karty MultiSport oraz ubezpieczenia
  • Sprawny proces rekrutacyjny (wideokonferencja), maksymalnie 2 spotkania online (pierwsze z kimś z zespołu, drugie z Managerem)
Karta sportowa
Ubezpieczenie

Inne informacje

  • Tryb realizacji usług: 100% zdalnie
  • Forma współpracy: kontrakt b2b
  • Język angielski: wymagany na poziomie zaawansowanym (C1) - codzienna współpraca w międzynarodowym środowisku
  • Sektor: FMCG
ITLT

ITLT

123 aktywne oferty

Zobacz wszystkie oferty
Aplikuj teraz