Poland
Poland
New

DevOps Engineer - AI Infrastructure & Orchestration

31.9k PLN/ mies.B2B
SeniorFull-time·B2B
#407031·Dodano 2 dni temu·2
Źródło: justjoin.it
Aplikuj teraz

Tech Stack / Keywords

DevOps/SRE

Firma i stanowisko

ITLT pomaga zaprzyjaźnionym firmom przekształcać ambitne pomysły w cyfrową rzeczywistość, współtworząc wyjątkowe rozwiązania IT, koncentrując się na wyzwaniach, technologii i zwinności.

Wymagania

  • Minimum 5 lat doświadczenia w DevOps/SRE
  • Minimum 2 lata doświadczenia w MLOps lub AI Infrastructure
  • Doświadczenie w deploymencie vLLM w środowisku produkcyjnym
  • Znajomość PagedAttention i continuous batching (vLLM)
  • Bardzo dobra znajomość Kubernetes i Openshift
  • Doświadczenie z infrastrukturą GPU NVIDIA (CUDA drivers, container toolkit, debugging)
  • Umiejętność zarządzania i debugowania środowisk GPU
  • Doświadczenie w budowie systemów observability od zera
  • Umiejętność tworzenia custom Prometheus exporters
  • Bardzo dobra znajomość Python (automation, tooling)
  • Znajomość Bash i Go
  • Doświadczenie w pracy z CI/CD (GitLab CI, Jenkins, ArgoCD)
  • Doświadczenie w środowiskach on-prem / bare-metal

Nice to have:

  • Znajomość GPU orchestration w Kubernetes (device plugins NVIDIA)
  • Znajomość model quantization (AWQ, GPTQ)
  • Znajomość FinOps dla AI infrastructure
  • Znajomość vector databases (Milvus, Qdrant)

Obowiązki

  • Deployment i utrzymanie vLLM na Openshift Kubernetes (bare-metal GPU)
  • Orkiestracja i optymalizacja GPU (NVIDIA)
  • Automatyzacja lifecycle modeli (HF/S3: pull, versioning, hot-swap)
  • HPA (queue depth, GPU memory)
  • Tuning vLLM (performance, batching, memory)
  • Metryki inference (tokeny, latency, errors) i tracking zużycia per user/API key
  • Grafana dashboards (GPU, TTFT, RPS, koszty, quota)
  • Alerting (GPU failures, latency, anomalies)
  • API Gateway (NGINX: auth, rate limit, routing)
  • Security, isolation i audit logging
  • Monitoring stack (Prometheus, Grafana, ELK, OpenTelemetry)
  • Automatyzacja (Python, Bash, Go)
  • CI/CD (GitLab CI, Jenkins, ArgoCD)
  • Utrzymanie SLA 99.9%, >70% GPU utilization, MTTR reduction

Benefity

  • Duża swoboda pracy zdalnej
  • Długofalowe stabilne zatrudnienie
  • Uczestnictwo w kluczowych projektach dla dużej firmy z sektora AI/Telco
  • Atrakcyjne wynagrodzenie adekwatne do doświadczenia
  • Benefity (Lux Med, MultiSport)
Elastyczne godziny
Opieka zdrowotna
Karta sportowa

Inne informacje

Informujemy, że administratorem danych jest IT Leasing Team z siedzibą w Warszawie, ul.Taśmowa 7. Masz prawo do żądania dostępu do swoich danych osobowych, ich sprostowania, usunięcia lub ograniczenia przetwarzania, prawo do sprzeciwu, prawo do przenoszenia danych oraz wniesienia skargi do organu nadzorczego. Dane będą przetwarzane w celu realizacji procesu rekrutacji. Podanie danych wynikających z Kodeksu pracy jest obowiązkowe. Dane będą przetwarzane do zakończenia rekrutacji lub do wycofania zgody na udział w przyszłych rekrutacjach.

Poland

Poland

6 aktywnych ofert

Zobacz wszystkie oferty
Aplikuj teraz