Lider / Liderka zespołu monitoringu IT
Brak informacji o wynagrodzeniu
SeniorFull-time
#447437·Dodano wczoraj·0
Źródło: mBankTech Stack / Keywords
ZabbixSplunkDBPlusobservabilityAIOpsLinuxRoot Cause AnalysisSREMajor Incident Management
Firma i stanowisko
Zespół pracuje w modelu 24/7, wykorzystując nowoczesne platformy monitoringu i observability do analizy zdarzeń, korelacji alertów oraz identyfikowania potencjalnych problemów, zanim wpłyną one na klientów i biznes. Operatorzy współpracują z zespołami infrastrukturalnymi, aplikacyjnymi i bezpieczeństwa oraz z dostawcami technologii. Organizacja przechodzi transformację od tradycyjnego modelu monitoringu do nowoczesnego podejścia opartego na observability, automatyzacji i działaniach wykorzystujących dane, wykorzystując platformy Zabbix, Splunk i DBPlus oraz praktyki SRE i AIOps.
Wymagania
- co najmniej 5 lat doświadczenia w zarządzaniu zespołami IT Operations, NOC, Monitoringu lub SRE
- bardzo dobra znajomość platformy Zabbix
- doświadczenie w obszarach IT Operations, Monitoringu, Event Management i Incident Management
- praktyczna znajomość systemów Linux
- umiejętność analizy źródłowych przyczyn awarii (Root Cause Analysis)
- doświadczenie w budowaniu procesów operacyjnych i zarządzaniu zespołami technicznymi
- skuteczna komunikacja z kadrą menedżerską, interesariuszami biznesowymi oraz technicznymi, np. administratorem Zabbixa
- gotowość do wchodzenia w szczegóły techniczne podczas analizy incydentów
- rozumienie różnicy między monitoringiem a observability
- umiejętność budowania zaangażowanych zespołów i rozwijania kompetencji pracowników
- myślenie procesowe oraz zdolność szybkiego działania w sytuacjach kryzysowych
- postrzeganie monitoringu jako strategicznej funkcji wspierającej niezawodność usług, a nie tylko jako narzędzia do generowania alertów
Obowiązki
- zarządzanie zespołem operatorów i inżynierów monitoringu
- całodobowy nadzór nad środowiskami produkcyjnymi
- rozwój strategii monitorowania infrastruktury, aplikacji, baz danych oraz usług chmurowych
- budowanie i utrzymywanie standardów monitoringu oraz observability
- nadzór nad platformą Zabbix oraz jej dalszym rozwojem
- współpraca z zespołami infrastrukturalnymi, deweloperskimi oraz bezpieczeństwa
- zarządzanie incydentami krytycznymi oraz koordynację działań w ramach Major Incident Management
- definiowanie KPI, SLA, SLO oraz wskaźników operacyjnych
- wdrażanie automatyzacji i mechanizmów samonaprawczych
- udział w projektach transformacyjnych związanych z centralizacją monitoringu i observability
mBank
19 aktywnych ofert