Data Engineer (Spark/Data Lakehouse) | Branża bankowa

Brak informacji o wynagrodzeniu
MidFull-time·Umowa o pracę
#426279·Dodano 3 dni temu·1
Źródło: justjoin.it
Aplikuj teraz

Tech Stack / Keywords

PythonApache SparkSpark SQLDataFramesMongoDBPrometheusGrafanaCI/CDAgileJira

Firma i stanowisko

Społeczność Edge One Solutions liczy ponad 350 ekspertów i jest częścią Grupy Euvic, w której łączna liczba pracowników to 5500. Klientem jest jeden z wiodących banków uniwersalnych w Polsce, należący do międzynarodowej grupy finansowej, oferujący kompleksowe usługi bankowe dla klientów indywidualnych i biznesowych oraz rozwijający rozwiązania w bankowości codziennej, finansowaniu i systemach płatniczych.

Wymagania

  • Minimum 4 lata doświadczenia w pracy z rozwiązaniami data engineeringowymi w środowiskach produkcyjnych.
  • Bardzo dobra znajomość Python, Apache Spark, PySpark, Spark SQL i DataFrames.
  • Doświadczenie ze Structured Streaming.
  • Praktyczna znajomość MongoDB oraz integracji ze Spark poprzez MongoDB Spark Connector.
  • Doświadczenie w modelowaniu danych dokumentowych oraz optymalizacji odczytu i indeksowania w MongoDB.
  • Praktyczne doświadczenie z Apache Iceberg, w tym wersjonowaniem tabel i operacjami merge/upsert.
  • Doświadczenie z Jenkins i procesami CI/CD (spark-unit, integration).
  • Znajomość Prometheus i Grafana.
  • Doświadczenie w pracy w Agile/Scrum lub Kanban oraz z Jira/Confluence.

Obowiązki

  • Projektowanie i implementacja procesów przetwarzania danych w PySpark i Spark SQL.
  • Rekoncyliacja danych pomiędzy ODS (MongoDB) a systemami źródłowymi.
  • Tworzenie reguł jakości danych oraz wykrywanie duplikatów, braków i anomalii.
  • Integracja Apache Spark z MongoDB przy użyciu MongoDB Spark Connector.
  • Projektowanie i rozwój warstw Raw/Bronze → Silver → Gold w architekturze Data Lakehouse.
  • Praca z Apache Iceberg, w tym wersjonowanie tabel oraz operacje upsert/merge.
  • Optymalizacja wydajności i kosztów przetwarzania danych w Spark.
  • Rozwój procesów batchowych i streamingowych oraz ich monitorowanie.
  • Automatyzacja deploymentu aplikacji Spark z wykorzystaniem Jenkins, Docker i Kubernetes.
  • Konfiguracja monitoringu i alertów z wykorzystaniem Prometheus i Grafana.
  • Diagnozowanie problemów związanych z jakością, spójnością i opóźnieniami danych.
  • Code review, prowadzenie warsztatów oraz tworzenie dokumentacji technicznej.
  • Współpraca z Data Engineerami, analitykami, testerami i zespołem DevOps w metodykach Scrum/Kanban.

Benefity

  • Pełne wsparcie w rozwoju zawodowym i indywidualna ścieżka kariery.
  • Wsparcie Service Delivery Managera.
  • Szkolenia, certyfikaty i konferencje z dofinansowaniem lub pełnym pokryciem kosztów.
  • Możliwość zmiany projektu zgodnie z preferencjami (#SmartChange).
  • Wyjścia integracyjne, aktywności sportowe i webinary #edge1talks.
  • Wsparcie sportowych inicjatyw i wynajem sal treningowych.
  • Pakiet zdrowotny obejmujący prywatną opiekę, kartę sportową, ubezpieczenie oraz wsparcie psychologiczne.
Dofinansowanie szkoleń
Budżet konferencyjny
Spotkania integracyjne
Karta sportowa
Opieka zdrowotna
Ubezpieczenie

Inne informacje

Informujemy, że administratorem danych jest Edge One Solutions sp. z siedzibą w Warszawie. Dane będą przetwarzane w celu realizacji procesu rekrutacji. Podanie danych obowiązkowych jest wymagane zgodnie z Kodeksem pracy. Administrator przetwarza dane na podstawie obowiązujących przepisów oraz zgody. Zgoda może zostać wycofana w dowolnym momencie. Odbiorcą danych jest serwis Just Join IT oraz inne podmioty powiązane z rekrutacją.

Edge One Solutions

Edge One Solutions

340 aktywnych ofert

Zobacz wszystkie oferty
Aplikuj teraz