ITSG
ITSG
New

Senior Data Scientist with Data Engineering Skills (kontraktor)

150 - 200 PLN/ godz.Zlecenie
SeniorFull-time·Umowa zlecenia
#434577·Dodano 3 dni temu·4
Źródło: ITSG
Aplikuj teraz

Tech Stack / Keywords

SQLPythonPandasNumPyBeautifulSoupScrapyREST APIGLMH2O.aiJupyter Notebook

Firma i stanowisko

Jesteśmy ITSG - wiodącym dostawcą spersonalizowanych rozwiązań dla wymagających klientów, dostarczającym produkty cyfrowe z wysoką jakością. Projekt dotyczy budowy systemu przewidywania popytu dla lidera polskiego rynku rozrywki, sieci kilkudziesięciu lokalizacji w całym kraju.

Wymagania

  • Minimum 5-7 lat praktycznego doświadczenia w obszarze Data Science lub pokrewnym.
  • Bardzo dobra znajomość SQL: projektowanie schematów, zapytania analityczne, optymalizacja.
  • Bardzo dobra znajomość Pythona w kontekście analizy, przetwarzania i przygotowywania danych.
  • Umiejętność samodzielnego tworzenia skryptów do pobierania i przetwarzania danych.
  • Doświadczenie z bibliotekami/narzędziami: Pandas, NumPy, BeautifulSoup, Scrapy lub podobnymi.
  • Doświadczenie z integracją danych z heterogenicznych źródeł, np. REST API, pliki flat, bazy legacy.
  • Doświadczenie z niekompletnymi, nieustrukturyzowanymi lub niewyczyszczonymi danymi.
  • Doświadczenie z eksploracyjną analizą danych.
  • Doświadczenie z modelami liniowymi / GLM i ich interpretacją.
  • Umiejętność walidacji modeli predykcyjnych oraz oceny jakości wyników.
  • Umiejętność samodzielnego przygotowania środowiska projektowego: Python, baza danych, zależności, repozytorium.

Nice to have:

  • Znajomość H2O.ai.
  • Znajomość Jupyter Notebook / JupyterLab.
  • Znajomość narzędzi do wersjonowania danych lub eksperymentów, np. DVC, MLflow.
  • Doświadczenie w projektach end-to-end: od pozyskania danych, przez analizę, po model predykcyjny.
  • Doświadczenie w pracy z narzędziami AI wspierającymi analizę lub development.

Obowiązki

  • Współpraca z architektem przy projektowaniu relacyjnej bazy danych w SQL: definiowanie schematu, typów danych, relacji i indeksów.
  • Pozyskiwanie danych z 3-4 źródeł zewnętrznych, w tym stron WWW, API, plików lub baz legacy.
  • Czyszczenie, transformacja i przygotowanie danych pod analizę oraz modelowanie.
  • Zasilanie bazy danych przygotowanymi danymi.
  • Eksploracyjna analiza danych (EDA): identyfikacja zależności, anomalii, braków i problemów jakościowych.
  • Dokumentowanie wyników analiz oraz założeń dotyczących danych.
  • Budowa i walidacja modelu ML klasy GLM.
  • Iteracyjna praca z modelem oraz interpretacja wyników.
  • Tworzenie skryptów w Pythonie do automatyzacji etapów pozyskiwania i przetwarzania danych.
  • Utrzymywanie porządku w kodzie i dokumentacji: repozytorium, wersjonowanie, powtarzalność wyników.
  • Przygotowywanie dokumentacji technicznej i analitycznej.
  • Wykorzystywanie narzędzi AI wspierających development i analizę, m.in. Claude Code, Codex.

Benefity

  • Stawka: 150-200 PLN/h.
  • Możliwość realizacji współpracy zdalnie, hybrydowo lub z biura w Warszawie.
  • Udział w projekcie tworzonym od podstaw z realnym wpływem na dane i modelowanie.
  • Możliwość działania end-to-end: od pozyskania danych, przez EDA, aż po model i interpretację dla biznesu.
  • Technologie: Python, SQL, Pandas, NumPy, GLM, H2O.ai, Jupyter Notebook / JupyterLab, Claude Code, Codex.
  • Elastyczne ramy realizacji zadań oraz ograniczona liczba spotkań.
  • Budżet szkoleniowy, lekcje języka angielskiego, karta Multisport, prywatna opieka medyczna, wydarzenia integracyjne.
Karta sportowa
Opieka zdrowotna
Dofinansowanie szkoleń
Kursy językowe
Spotkania integracyjne
ITSG

ITSG

Pracodawca

Aplikuj teraz