Data Engineer
⚲ Warszawa
Do uzgodnienia
Wymagania
- Bardzo dobra znajomość Pythona oraz SQL
- Doświadczenie w przetwarzaniu dużych wolumenów danych z użyciem Spark i Polars
- Doświadczenie z analitycznymi bazami danych typu kolumnowego
- Doświadczenie w pracy w sektorze operującym na dużej skali danych
- Doświadczenie w projektowaniu i modelowaniu struktur danych pod zaawansowaną analitykę oraz systemy czasu zbliżonego do rzeczywistego
Mile widziane
- Znajomość ClickHouse i/lub StarRocks
- Znajomość Kubernetes oraz narzędzi GitOps (ArgoCD)
- Doświadczenie w branży RTB / programmatic advertising, projektach ML lub znajomość Go
Opis stanowiska
Dołączysz do zespołu danych Wirtualnej Polski, gdzie będziesz budować i optymalizować pipeline'y zasilające modele ML oraz warstwę przechowywania danych pod analitykę i systemy Real-Time. W praktyce zajmiesz się modelowaniem struktur danych, tworzeniem dashboardów i alertów wykrywających anomalie oraz spadki jakości danych, a także narzędziami do monitorowania modeli produkcyjnych (m.in. distribution shift) i wdrażaniem CI/CD dla modeli predykcyjnych. To oferta dla inżyniera danych, który lubi pracować na dużej skali i chce mieć realny wpływ na jakość danych zasilających produkcję ML. Uwaga: praca hybrydowa oznacza 3 dni w biurze tygodniowo — jeśli zależy Ci na pełnym remote, to warto to uwzględnić przed aplikowaniem.
🔍 Dekoder Ogłoszenia
✓ Ogłoszenie wygląda transparentnie — brak typowych czerwonych flag.