Inżynier/ka Danych
140 - 149 PLN/ godz.B2B
SeniorFull-time·B2B
#406801·Dodano 7 dni temu·0
Źródło: nofluffjobs.comTech Stack / Keywords
Google Cloud PlatformSQLPythonBigQuerydbtApache AirflowGCPApache SparkGitHub ActionsGit
Firma i stanowisko
AVENGA (Agencja Pracy, nr KRAZ: 8448) is recruiting for a data engineering role based in Warszawa, Poland.
Wymagania
- Minimum 5 lat doświadczenia komercyjnego w inżynierii danych, w tym min. 2 lata w projektach opartych o Google Cloud Platform
- Doświadczenie w projektowaniu i wdrożeniu hurtowni danych / data lakehouse w środowisku produkcyjnym o dużej skali
- Umiejętność projektowania rozwiązań end-to-end i uzasadniania decyzji architektonicznych
- Komunikatywność i umiejętność współpracy z analitykami, data scientistami oraz stakeholderami biznesowymi
- Zaawansowana znajomość SQL — złożone zapytania analityczne, window functions, CTE, optymalizacja zapytań, modelowanie danych
- Zaawansowana znajomość Python — programowanie obiektowe, pisanie modułów produkcyjnych, testy jednostkowe, praca z bibliotekami do przetwarzania danych (pandas, numpy)
- Praktyczna znajomość ekosystemu GCP: IAM, Cloud Storage, Secret Manager, Cloud Logging / Monitoring
- Znajomość BigQuery — projektowanie schematów, partycjonowanie i klastrowanie tabel, optymalizacja kosztów i wydajności zapytań
- Doświadczenie z dbt (Core lub Cloud) — budowanie modeli, makra, testy, snapshoty, dokumentacja
- Znajomość Apache Airflow — projektowanie DAG-ów produkcyjnych, orkiestracja pipeline'ów dbt i zadań GCP
- Doświadczenie z Apache Spark — pisanie zadań PySpark, optymalizacja jobów
- Znajomość CI/CD — GitHub Actions, automatyzacja testów i deploymentu pipeline'ów danych
- Biegłość w Git — praca z gałęziami, pull requestami, code review, git flow
Obowiązki
- Budowa i utrzymanie pipeline'ów danych w dbt oraz orkiestracja przepływów w Airflow
- Rozwój komponentów przetwarzania danych w Python oraz PySpark
- Projektowanie i rozwój warstw Gold i Platinum platformy lakehouse (architektura medallion) w BigQuery
- Optymalizacja wydajności i kosztów w BigQuery (partycjonowanie, klastrowanie, FinOps)
- Budowa i utrzymanie procesów CI/CD (GitHub Actions) oraz infrastruktury jako kodu (Terraform)
- Implementacja modelu bezpieczeństwa danych (IAM, RBAC/ABAC, policy tags, DLP)
- Współtworzenie standardów Data Governance (Dataplex, metadane, data lineage)
- Udział w code review i kształtowaniu standardów pracy zespołu
- Konsultacje techniczne dla zespołów domenowych w modelu hub & spoke oraz promowanie dobrych praktyk inżynierii danych na GCP
Benefity
- Sport subscription
- Private healthcare
- Flat structure
Karta sportowa
Opieka zdrowotna
AVENGA (Agencja Pracy, nr KRAZ: 8448)
64 aktywne oferty