Senior Site Reliability Engineer (DevOps + Java)
⚲ Remote
23 520 - 28 560 PLN (B2B)
Wymagania
- Java
- Kubernetes
- AWS
- Docker
- CI/CD
- Terraform
- Pulumi
- MS SQL
- PostgreSQL
- Redis
- DynamoDB
- MongoDB
- Prometheus
- Grafana
- Datadog
- Ruby on Rails (nice to have)
- Ruby (nice to have)
Opis stanowiska
O projekcie:
Dla naszego klienta – firmy rozwijającej globalną platformę
mobilności – poszukujemy Senior Site Reliability Engineera (DevOps + Java). Projekt dotyczy jednej z największych platform związanych z
zamawianiem przejazdów. Rozwiązanie umożliwia użytkownikom zamawianie taksówek,
śledzenie przejazdów, realizację płatności oraz zarządzanie historią podróży.
Wymagania:
Minimum 7 lat doświadczenia zawodowego.
Doświadczenie w roli Senior SRE / Senior DevOps Engineer /
Platform Engineer.
Bardzo
dobra znajomość Kubernetes (Deployments, StatefulSets, Services, Ingress, Helm,
troubleshooting, autoscaling).
Bardzo dobra znajomość AWS: EC2, EKS, RDS, S3, IAM, VPC,
Load Balancing, CloudWatch.
Praktyczne doświadczenie z Dockerem i środowiskami
kontenerowymi.
Doświadczenie z CI/CD oraz Infrastructure as Code:
Terraform, CloudFormation, Pulumi lub podobne.
Bardzo dobra znajomość języka Java oraz działania aplikacji
JVM.
Znajomość zagadnień związanych z: concurrency, wydajnością
aplikacji, analizą problemów runtime.
Doświadczenie z systemami kolejkowymi: RabbitMQ, Kafka, SQS,
Pulsar lub podobne.
Znajomość baz danych: MySQL/PostgreSQL, Redis, DynamoDB,
MongoDB.
Doświadczenie w pracy z systemami rozproszonymi i
mikroserwisami.
Znajomość narzędzi monitoringu: Prometheus, Grafana,
Datadog, ELK/OpenSearch, OpenTelemetry.
Bardzo dobra znajomość Linux oraz podstaw sieci: TCP/IP,
DNS, HTTP/HTTPS, TLS.
Doświadczenie z praktykami SRE: incident management, load
testing, resilience testing.
Język angielski na poziomie umożliwiającą swobodną,
codzienną komunikację.
Nice to have:
Znajomość Ruby oraz ekosystemu Ruby on Rails.
Doświadczenie z dużymi platformami SaaS.
Doświadczenie w optymalizacji kosztów chmurowych.
Znajomość praktyk Chaos Engineering.
Doświadczenie w mentoringu innych inżynierów.
Codzienne zadania:
- Projektowanie, rozwój i utrzymanie skalowalnych oraz niezawodnych systemów rozproszonych.
- Zapewnienie wysokiej dostępności i stabilności środowisk produkcyjnych.
- Automatyzacja procesów infrastrukturalnych, wdrożeń oraz działań operacyjnych.
- Rozwiązywanie problemów produkcyjnych i analiza przyczyn awarii.
- Wspieranie procesów migracji oraz modernizacji systemów.
- Udział w dyżurach on-call i reagowaniu na incydenty.
- Współpraca z zespołami developerskimi w celu poprawy jakości i operacyjności aplikacji.
- Rozwijanie monitoringu, alertingu i narzędzi observability.
- Automatyzacja powtarzalnych procesów oraz redukcja pracy manualnej.
- Udział w działaniach związanych z SRE: SLO, SLI, SLA, disaster recovery oraz ciągłym doskonaleniem systemów.
Dla naszego klienta – firmy rozwijającej globalną platformę
mobilności – poszukujemy Senior Site Reliability Engineera (DevOps + Java). Projekt dotyczy jednej z największych platform związanych z
zamawianiem przejazdów. Rozwiązanie umożliwia użytkownikom zamawianie taksówek,
śledzenie przejazdów, realizację płatności oraz zarządzanie historią podróży.
Wymagania:
Minimum 7 lat doświadczenia zawodowego.
Doświadczenie w roli Senior SRE / Senior DevOps Engineer /
Platform Engineer.
Bardzo
dobra znajomość Kubernetes (Deployments, StatefulSets, Services, Ingress, Helm,
troubleshooting, autoscaling).
Bardzo dobra znajomość AWS: EC2, EKS, RDS, S3, IAM, VPC,
Load Balancing, CloudWatch.
Praktyczne doświadczenie z Dockerem i środowiskami
kontenerowymi.
Doświadczenie z CI/CD oraz Infrastructure as Code:
Terraform, CloudFormation, Pulumi lub podobne.
Bardzo dobra znajomość języka Java oraz działania aplikacji
JVM.
Znajomość zagadnień związanych z: concurrency, wydajnością
aplikacji, analizą problemów runtime.
Doświadczenie z systemami kolejkowymi: RabbitMQ, Kafka, SQS,
Pulsar lub podobne.
Znajomość baz danych: MySQL/PostgreSQL, Redis, DynamoDB,
MongoDB.
Doświadczenie w pracy z systemami rozproszonymi i
mikroserwisami.
Znajomość narzędzi monitoringu: Prometheus, Grafana,
Datadog, ELK/OpenSearch, OpenTelemetry.
Bardzo dobra znajomość Linux oraz podstaw sieci: TCP/IP,
DNS, HTTP/HTTPS, TLS.
Doświadczenie z praktykami SRE: incident management, load
testing, resilience testing.
Język angielski na poziomie umożliwiającą swobodną,
codzienną komunikację.
Nice to have:
Znajomość Ruby oraz ekosystemu Ruby on Rails.
Doświadczenie z dużymi platformami SaaS.
Doświadczenie w optymalizacji kosztów chmurowych.
Znajomość praktyk Chaos Engineering.
Doświadczenie w mentoringu innych inżynierów.
Codzienne zadania:
- Projektowanie, rozwój i utrzymanie skalowalnych oraz niezawodnych systemów rozproszonych.
- Zapewnienie wysokiej dostępności i stabilności środowisk produkcyjnych.
- Automatyzacja procesów infrastrukturalnych, wdrożeń oraz działań operacyjnych.
- Rozwiązywanie problemów produkcyjnych i analiza przyczyn awarii.
- Wspieranie procesów migracji oraz modernizacji systemów.
- Udział w dyżurach on-call i reagowaniu na incydenty.
- Współpraca z zespołami developerskimi w celu poprawy jakości i operacyjności aplikacji.
- Rozwijanie monitoringu, alertingu i narzędzi observability.
- Automatyzacja powtarzalnych procesów oraz redukcja pracy manualnej.
- Udział w działaniach związanych z SRE: SLO, SLI, SLA, disaster recovery oraz ciągłym doskonaleniem systemów.
🔍 Dekoder Ogłoszenia
🔴
Minimum 7 lat doświadczenia zawodowego.
Może oznaczać, że szukają kogoś, kto od razu będzie samodzielny i nie będzie wymagał dużego wsparcia, a niekoniecznie kogoś z głęboką wiedzą ekspercką.
🔴
Doświadczenie w roli Senior SRE / Senior DevOps Engineer / Platform Engineer.
Może sugerować, że poszukują osoby z szerokim zakresem obowiązków, a niekoniecznie głęboką specjalizacją w SRE.
🔴
Bardzo dobra znajomość języka Java oraz działania aplikacji JVM.
Może oznaczać, że główny nacisk będzie położony na rozwój i utrzymanie aplikacji w Javie, a nie tylko na aspekty SRE/DevOps.
🔴
Doświadczenie z praktykami SRE: incident management, load testing, resilienc
Może oznaczać, że oczekuje się od kandydata aktywnego udziału w rozwiązywaniu problemów i zapewnianiu ciągłości działania, co może wiązać się z dyżurami i pracą poza standardowymi godzinami.
🟡
Rozwiązanie umożliwia użytkownikom zamawianie taksówek, śledzenie przejazdów, realizację płatności oraz zarządzanie historią podróży.
Opis projektu może sugerować, że praca będzie dotyczyła bardzo krytycznego i obciążonego systemu, co może oznaczać wysokie wymagania dotyczące stabilności i wydajności.