AI/ML Engineer
160 - 190 PLN/ godz.B2B
MidFull-time·B2B
#401567·Dodano 2 dni temu·1
Źródło: nofluffjobs.comTech Stack / Keywords
AWSPythonLLMAgentic AIRAGFastAPILangchainLanggraphMongoDBVector SearchOpen SearchRedisPostgreSQL
Firma i stanowisko
Wspólnie z naszym Partnerem, amerykańskim producentem sprzętu fitness rozwijającym platformę aplikacyjną nowej generacji, poszukujemy doświadczonej osoby do świadczenia usług w charakterze AI Engineer. Realizacja usług dotyczy budowanego od podstaw obszaru R&D, obejmującego przejęcie developmentu aplikacji mobilnej stworzonej w USA. Aplikacja ta ma ambicję stać się najlepszą platformą treningową na świecie: AI-driven, hiperspersonalizowaną, zintegrowaną z wearables, danymi medycznymi i urządzeniami fitness.
Wymagania
- 5+ lat doświadczenia w oprogramowaniu produkcyjnym.
- Doświadczenie produkcyjne w Python 3.11 - typed async services na poziomie seniorskim.
- Doświadczenie w projektowaniu agentów LLM w LangGraph/LangChain lub porównywalnym frameworku (graph topology, tool contracts).
- Minimum 3 miesiące odpowiedzialności za funkcję AI/ML/LLM w produkcji, obejmujące systemy agentowe i tool-calling.
- Samodzielność i ownership pracy w środowisku bez gotowych specyfikacji.
- Pełna odpowiedzialność za serwis w FastAPI (endpoint, worker, schema, testy).
- Znajomość RAG / Retrieval: embeddings, vector search, hybrid ranking.
- Doświadczenie z personalizacją i rankingiem na sygnałach behawioralnych.
- Komunikatywność w języku angielskim.
Nice to have:
- Znajomość LangChain, LangGraph, Celery, AWS, MongoDB Atlas Vector Search, OpenSearch, Redis, PostgreSQL, Docker/Terraform, Datadog/Opik/Amplitude, TypeScript, NestJS, React Native, bandits/uplift modeling, produkty głosowe/TTS.
Obowiązki
- Optymalizacja latencji i kosztu: pre-generowanie treści, cache keyed do session revision, deduplikacja przez content fingerprinting.
- Utrzymanie i rozbudowa suite'ów ewaluacyjnych, model-based judging, dodawanie test case'a po każdej produkcyjnej awarii.
- Implementacja pipeline'u personalizacji: ekstrakcja sygnałów per-turn, synteza profilu, cache z invalidacją epokową.
- Pisanie i utrzymanie serwisu FastAPI, workerów Celery, schematów Pydantic i testów pytest.
- Projektowanie i rozwój topologii grafu agenta oraz tool contracts w LangGraph/LangChain.
- Budowa i tuning retrievalu: embeddingi, hybrid ranking, hard pre-filters nad vector store.
- Monitorowanie produkcji: traces, token usage, metryki jakości, rollout za feature flagą.
Benefity
- Możliwość aplikacji z AI Rekruterem (AIR) dostępny 24/7.
- Enterprise-grade tooling bez ograniczeń: Claude Enterprise, GitHub Enterprise, pełna infrastruktura AWS.
- Współpraca projektowa z rozliczeniem opartym na etapach i protokołach odbioru deliverables.
- Wsparcie administracyjne i rozliczeniowe ze strony Connectis.
- Praca w 100% zdalnie w dynamicznym, scale-up'owym środowisku.
- Uczestnictwo w wydarzeniach branżowych oraz meetupach technologicznych.
- Elastyczna forma współpracy B2B.
- Szybki i zdalny proces rekrutacji.
Elastyczne godziny
Connectis_
130 aktywnych ofert