Site Reliability Engineer
EPAM Systems (Poland) sp. z o.o.
⚲ Kraków, Grzegórzki
Do uzgodnienia
Wymagania
- wykształcenie wyższe w informatyce, inżynierii lub pokrewne
- 3+ lata hands-on doświadczenia w SRE lub pokrewnej roli
- doświadczenie z co najmniej jedną chmurą (AWS/GCP/Azure)
- doświadczenie w implementacji praktyk SRE: SLO/SLI, error budgets, postmortemy, redukcja toil, capacity planning, incident management
- Python lub inny język skryptowy/programowania
- angielski min. B2 (Upper-Intermediate)
Mile widziane
- certyfikat Kubernetes/AWS/GCP/Azure lub podobny
- doświadczenie z LLM, RAG, AI agents, AI cloud services (AWS Bedrock, Vertex AI, Azure AI) oraz narzędziami typu Cursor/Claude Code
Opis stanowiska
EPAM szuka Site Reliability Engineera do pracy z zespołami developerskimi i operacyjnymi nad niezawodnością, skalowalnością i wydajnością systemów. Zakres obejmuje wdrażanie praktyk SRE (SLO/SLI, error budgets, postmortemy, redukcja toil), monitoring, IaC, CI/CD oraz — co wyróżnia tę ofertę — adopcję AI w platformie (GenAI, agenci autonomiczni, AIOps). To dobra oferta dla SRE z 3+ latami doświadczenia, który chce rozwijać się w kierunku AI-enabled platform capabilities. Uwaga: 'Incident Management' w wymaganiach oznacza realne dyżury i pracę w trybie reagowania na incydenty.
🔍 Dekoder Ogłoszenia
🟡
Reducing Toil
Może oznaczać, że obecnie występuje dużo pracy manualnej i powtarzalnej do zautomatyzowania.
🔴
Incident Management
Możliwe dyżury i praca w trybie reagowania na incydenty.
🟡
Mile widziane: Certification...
Wymagania 'mile widziane' bywają traktowane jako faktyczne oczekiwania.