Senior Data Scientist with Data Engineering Skills (kontraktor)
150 - 200 PLN/ godz.Zlecenie
SeniorFull-time·Umowa zlecenia
#434577·Dodano 3 dni temu·4
Źródło: ITSGTech Stack / Keywords
SQLPythonPandasNumPyBeautifulSoupScrapyREST APIGLMH2O.aiJupyter Notebook
Firma i stanowisko
Jesteśmy ITSG - wiodącym dostawcą spersonalizowanych rozwiązań dla wymagających klientów, dostarczającym produkty cyfrowe z wysoką jakością. Projekt dotyczy budowy systemu przewidywania popytu dla lidera polskiego rynku rozrywki, sieci kilkudziesięciu lokalizacji w całym kraju.
Wymagania
- Minimum 5-7 lat praktycznego doświadczenia w obszarze Data Science lub pokrewnym.
- Bardzo dobra znajomość SQL: projektowanie schematów, zapytania analityczne, optymalizacja.
- Bardzo dobra znajomość Pythona w kontekście analizy, przetwarzania i przygotowywania danych.
- Umiejętność samodzielnego tworzenia skryptów do pobierania i przetwarzania danych.
- Doświadczenie z bibliotekami/narzędziami: Pandas, NumPy, BeautifulSoup, Scrapy lub podobnymi.
- Doświadczenie z integracją danych z heterogenicznych źródeł, np. REST API, pliki flat, bazy legacy.
- Doświadczenie z niekompletnymi, nieustrukturyzowanymi lub niewyczyszczonymi danymi.
- Doświadczenie z eksploracyjną analizą danych.
- Doświadczenie z modelami liniowymi / GLM i ich interpretacją.
- Umiejętność walidacji modeli predykcyjnych oraz oceny jakości wyników.
- Umiejętność samodzielnego przygotowania środowiska projektowego: Python, baza danych, zależności, repozytorium.
Nice to have:
- Znajomość H2O.ai.
- Znajomość Jupyter Notebook / JupyterLab.
- Znajomość narzędzi do wersjonowania danych lub eksperymentów, np. DVC, MLflow.
- Doświadczenie w projektach end-to-end: od pozyskania danych, przez analizę, po model predykcyjny.
- Doświadczenie w pracy z narzędziami AI wspierającymi analizę lub development.
Obowiązki
- Współpraca z architektem przy projektowaniu relacyjnej bazy danych w SQL: definiowanie schematu, typów danych, relacji i indeksów.
- Pozyskiwanie danych z 3-4 źródeł zewnętrznych, w tym stron WWW, API, plików lub baz legacy.
- Czyszczenie, transformacja i przygotowanie danych pod analizę oraz modelowanie.
- Zasilanie bazy danych przygotowanymi danymi.
- Eksploracyjna analiza danych (EDA): identyfikacja zależności, anomalii, braków i problemów jakościowych.
- Dokumentowanie wyników analiz oraz założeń dotyczących danych.
- Budowa i walidacja modelu ML klasy GLM.
- Iteracyjna praca z modelem oraz interpretacja wyników.
- Tworzenie skryptów w Pythonie do automatyzacji etapów pozyskiwania i przetwarzania danych.
- Utrzymywanie porządku w kodzie i dokumentacji: repozytorium, wersjonowanie, powtarzalność wyników.
- Przygotowywanie dokumentacji technicznej i analitycznej.
- Wykorzystywanie narzędzi AI wspierających development i analizę, m.in. Claude Code, Codex.
Benefity
- Stawka: 150-200 PLN/h.
- Możliwość realizacji współpracy zdalnie, hybrydowo lub z biura w Warszawie.
- Udział w projekcie tworzonym od podstaw z realnym wpływem na dane i modelowanie.
- Możliwość działania end-to-end: od pozyskania danych, przez EDA, aż po model i interpretację dla biznesu.
- Technologie: Python, SQL, Pandas, NumPy, GLM, H2O.ai, Jupyter Notebook / JupyterLab, Claude Code, Codex.
- Elastyczne ramy realizacji zadań oraz ograniczona liczba spotkań.
- Budżet szkoleniowy, lekcje języka angielskiego, karta Multisport, prywatna opieka medyczna, wydarzenia integracyjne.
Karta sportowa
Opieka zdrowotna
Dofinansowanie szkoleń
Kursy językowe
Spotkania integracyjne
ITSG
Pracodawca