Service Engineer (DevOps/SRE) - IT Contracting
⚲ Warszawa
8 000–11 000 zł netto (+ VAT) / mies.
Wymagania
- Ceph
- Ansible
- Terraform
- Python
- Bash
- Prometheus
- Grafana
- Kubernetes
- Puppet
- Go
- ELK
- HashiCorp Vault
- AWS
- Weka
- Qumulo
- CephFS
- RBD
Opis stanowiska
Nasze wymagania:
Poszukujemy osoby posiadającej doświadczenie w administracji i utrzymaniu rozproszonych platform storage, która łączy kompetencje infrastrukturalne z podejściem DevOps oraz SRE.
Minimum 2 lata doświadczenia zawodowego na stanowisku związanym z infrastrukturą IT, storage lub platform engineering.
Praktyczne doświadczenie w projektowaniu, wdrażaniu, administracji i utrzymaniu środowisk Ceph w środowisku produkcyjnym.
Doświadczenie w zarządzaniu pełnym cyklem życia klastrów Ceph, obejmującym wdrożenia, aktualizacje, rozbudowę, monitoring, troubleshooting oraz optymalizację wydajności.
Bardzo dobra znajomość architekturyCeph, w tym: OSD, MON, MGR, CRUSH Maps, RBD, CephFS, RGW, mechanizmów replikacji i erasure coding.
Doświadczenie w automatyzacji infrastruktury z wykorzystaniem Ansible, Terraform, Python, Bash lub pokrewnych technologii.
Praktyczna znajomość Kubernetes i środowisk kontenerowych.
Doświadczenie administracyjne w systemach Linux.
Znajomość zagadnień sieciowych związanych z utrzymaniem rozproszonych platform storage.
Znajomość praktyk Site Reliability Engineering (SRE) oraz Operational Excellence.
Doświadczenie w zarządzaniu konfiguracją z wykorzystaniem Puppet.
Umiejętność budowania i rozwijania rozwiązań Infrastructure-as-Code.
Doświadczenie w tworzeniu i utrzymaniu procesów CI/CD dla infrastruktury.
Znajomość narzędzi monitoringu, logowania i observability, takich jak Prometheus, Grafana czy ELK.
Doświadczenie w obsłudze incydentów, analizie przyczyn źródłowych problemów oraz wdrażaniu działań zapobiegawczych.
Dobre umiejętności skryptowania w Python, Bash, Go lub podobnych językach.
Mile widziane:
Doświadczenie z platformami storage wykorzystywanymi w środowiskach HPC.
Znajomość rozwiązań Weka, Qumulo lub innych zaawansowanych platform pamięci masowej.
Doświadczenie w pracy ze środowiskami hybrydowymi i chmurą publiczną (preferowany AWS).
Doświadczenie w utrzymaniu infrastruktury dla środowisk AI/ML, Big Data lub dużych klastrów Kubernetes.
Znajomość HashiCorp Vault lub innych rozwiązań do zarządzania sekretami.
O projekcie:
Naszym klientem jest globalna organizacja z sektora life sciences, realizująca strategiczne inicjatywy związane z transformacją cyfrową oraz rozwojem nowoczesnej infrastruktury IT. Firma inwestuje w rozwiązania cloud-native, automatyzację i platformy danych o znaczeniu krytycznym dla działalności biznesowej oraz badawczej. Praca odbywa się w międzynarodowym środowisku z wykorzystaniem najnowszych technologii i najlepszych praktyk DevOps oraz SRE.
Zakres obowiązków:
Jako Technology Infrastructure Services Engineer będziesz odpowiedzialny za projektowanie, wdrażanie, utrzymanie i ciągłe doskonalenie korporacyjnych platform storage opartych o technologię Ceph. Twoim głównym celem będzie zapewnienie wysokiej dostępności, wydajności, skalowalności i bezpieczeństwa środowisk wspierających strategiczne usługi biznesowe oraz badawcze.
Do głównych obowiązków należeć będzie:
Projektowanie i rozwój rozproszonych środowisk storage opartych na Ceph.
Administracja produkcyjnymi klastrami Ceph, w tym rozbudowa infrastruktury, aktualizacje, zarządzanie cyklem życia oraz rozwiązywanie problemów technicznych.
Monitorowanie stanu platformy, analiza wydajności i realizacja działań związanych z capacity planning.
Automatyzacja procesów operacyjnych z wykorzystaniem Ansible, Terraform, Python, Bash oraz innych narzędzi Infrastructure-as-Code.
Tworzenie narzędzi operacyjnych, runbooków oraz rozwiązań self-service zwiększających efektywność zespołu.
Wdrażanie i rozwijanie rozwiązań monitoringu, alertingu oraz observability z wykorzystaniem narzędzi takich jak Prometheus, Grafana czy ELK.
Współpraca z zespołami platformowymi, deweloperskimi i operacyjnymi w zakresie integracji Ceph z Kubernetes oraz środowiskami cloud-native.
Udział w procesach Incident Management, analizach Root Cause Analysis (RCA) oraz działaniach Continuous Improvement.
Zarządzanie konfiguracją infrastruktury przy wykorzystaniu Puppet i innych narzędzi automatyzacyjnych.
Wspieranie wdrożeń związanych z bezpieczeństwem infrastruktury, w tym wykorzystania rozwiązań takich jak HashiCorp Vault.
Praca z dodatkowymi platformami storage, takimi jak Weka i Qumulo.
Wspieranie środowisk hybrydowych oraz chmurowych, ze szczególnym uwzględnieniem AWS.
Stanowisko jest idealne dla osób, które lubią pracować z dużymi systemami rozproszonymi, poszukują możliwości wpływania na architekturę platform infrastrukturalnych oraz chcą aktywnie rozwijać automatyzację i niezawodność środowisk IT.
Oferujemy:
Praca hybrydowa - 1-2 dni w tygodniu w biurze w Warszawie
Umowa B2B via Michael Page
Poszukujemy osoby posiadającej doświadczenie w administracji i utrzymaniu rozproszonych platform storage, która łączy kompetencje infrastrukturalne z podejściem DevOps oraz SRE.
Minimum 2 lata doświadczenia zawodowego na stanowisku związanym z infrastrukturą IT, storage lub platform engineering.
Praktyczne doświadczenie w projektowaniu, wdrażaniu, administracji i utrzymaniu środowisk Ceph w środowisku produkcyjnym.
Doświadczenie w zarządzaniu pełnym cyklem życia klastrów Ceph, obejmującym wdrożenia, aktualizacje, rozbudowę, monitoring, troubleshooting oraz optymalizację wydajności.
Bardzo dobra znajomość architekturyCeph, w tym: OSD, MON, MGR, CRUSH Maps, RBD, CephFS, RGW, mechanizmów replikacji i erasure coding.
Doświadczenie w automatyzacji infrastruktury z wykorzystaniem Ansible, Terraform, Python, Bash lub pokrewnych technologii.
Praktyczna znajomość Kubernetes i środowisk kontenerowych.
Doświadczenie administracyjne w systemach Linux.
Znajomość zagadnień sieciowych związanych z utrzymaniem rozproszonych platform storage.
Znajomość praktyk Site Reliability Engineering (SRE) oraz Operational Excellence.
Doświadczenie w zarządzaniu konfiguracją z wykorzystaniem Puppet.
Umiejętność budowania i rozwijania rozwiązań Infrastructure-as-Code.
Doświadczenie w tworzeniu i utrzymaniu procesów CI/CD dla infrastruktury.
Znajomość narzędzi monitoringu, logowania i observability, takich jak Prometheus, Grafana czy ELK.
Doświadczenie w obsłudze incydentów, analizie przyczyn źródłowych problemów oraz wdrażaniu działań zapobiegawczych.
Dobre umiejętności skryptowania w Python, Bash, Go lub podobnych językach.
Mile widziane:
Doświadczenie z platformami storage wykorzystywanymi w środowiskach HPC.
Znajomość rozwiązań Weka, Qumulo lub innych zaawansowanych platform pamięci masowej.
Doświadczenie w pracy ze środowiskami hybrydowymi i chmurą publiczną (preferowany AWS).
Doświadczenie w utrzymaniu infrastruktury dla środowisk AI/ML, Big Data lub dużych klastrów Kubernetes.
Znajomość HashiCorp Vault lub innych rozwiązań do zarządzania sekretami.
O projekcie:
Naszym klientem jest globalna organizacja z sektora life sciences, realizująca strategiczne inicjatywy związane z transformacją cyfrową oraz rozwojem nowoczesnej infrastruktury IT. Firma inwestuje w rozwiązania cloud-native, automatyzację i platformy danych o znaczeniu krytycznym dla działalności biznesowej oraz badawczej. Praca odbywa się w międzynarodowym środowisku z wykorzystaniem najnowszych technologii i najlepszych praktyk DevOps oraz SRE.
Zakres obowiązków:
Jako Technology Infrastructure Services Engineer będziesz odpowiedzialny za projektowanie, wdrażanie, utrzymanie i ciągłe doskonalenie korporacyjnych platform storage opartych o technologię Ceph. Twoim głównym celem będzie zapewnienie wysokiej dostępności, wydajności, skalowalności i bezpieczeństwa środowisk wspierających strategiczne usługi biznesowe oraz badawcze.
Do głównych obowiązków należeć będzie:
Projektowanie i rozwój rozproszonych środowisk storage opartych na Ceph.
Administracja produkcyjnymi klastrami Ceph, w tym rozbudowa infrastruktury, aktualizacje, zarządzanie cyklem życia oraz rozwiązywanie problemów technicznych.
Monitorowanie stanu platformy, analiza wydajności i realizacja działań związanych z capacity planning.
Automatyzacja procesów operacyjnych z wykorzystaniem Ansible, Terraform, Python, Bash oraz innych narzędzi Infrastructure-as-Code.
Tworzenie narzędzi operacyjnych, runbooków oraz rozwiązań self-service zwiększających efektywność zespołu.
Wdrażanie i rozwijanie rozwiązań monitoringu, alertingu oraz observability z wykorzystaniem narzędzi takich jak Prometheus, Grafana czy ELK.
Współpraca z zespołami platformowymi, deweloperskimi i operacyjnymi w zakresie integracji Ceph z Kubernetes oraz środowiskami cloud-native.
Udział w procesach Incident Management, analizach Root Cause Analysis (RCA) oraz działaniach Continuous Improvement.
Zarządzanie konfiguracją infrastruktury przy wykorzystaniu Puppet i innych narzędzi automatyzacyjnych.
Wspieranie wdrożeń związanych z bezpieczeństwem infrastruktury, w tym wykorzystania rozwiązań takich jak HashiCorp Vault.
Praca z dodatkowymi platformami storage, takimi jak Weka i Qumulo.
Wspieranie środowisk hybrydowych oraz chmurowych, ze szczególnym uwzględnieniem AWS.
Stanowisko jest idealne dla osób, które lubią pracować z dużymi systemami rozproszonymi, poszukują możliwości wpływania na architekturę platform infrastrukturalnych oraz chcą aktywnie rozwijać automatyzację i niezawodność środowisk IT.
Oferujemy:
Praca hybrydowa - 1-2 dni w tygodniu w biurze w Warszawie
Umowa B2B via Michael Page
🔍 Dekoder Ogłoszenia
🟡
podejściem DevOps oraz SRE
Oczekuje się, że kandydat będzie potrafił zarówno wdrażać i utrzymywać infrastrukturę, jak i aktywnie uczestniczyć w procesach rozwoju i automatyzacji.
🔴
Minimum 2 lata doświadczenia zawodowego na stanowisku związanym z infrastrukturą IT, storage lub platform engineering.
Chociaż podano minimum 2 lata, realnie szukają kogoś z większym doświadczeniem, kto faktycznie potrafi samodzielnie zarządzać złożonymi systemami.
🟡
Praktyczne doświadczenie w projektowaniu, wdrażaniu, administracji i utrzymaniu środowisk Ceph w środowisku produkcyjnym.
Wymagane jest nie tylko teoretyczne pojęcie, ale faktyczne, samodzielne działanie z Ceph w realnym, działającym środowisku.
🟡
Znajomość praktyk Site Reliability Engineering (SRE) oraz Operational Excellence.
Oczekuje się nie tylko znajomości narzędzi, ale przede wszystkim zrozumienia i stosowania filozofii SRE, która często wiąże się z odpowiedzialnością za dostępność i wydajność.
🔴
Doświadczenie w obsłudze incydentów, analizie przy
Ostatnie zdanie jest niedokończone, co może sugerować pośpiech w tworzeniu ogłoszenia lub brak pełnego doprecyzowania zakresu obowiązków związanych z incydentami.