Production Engineer/SRE
⚲ Kraków
21 000 - 25 200 PLN (B2B)
Wymagania
- Linux
- SQL
- Python (nice to have)
- Kubernetes (nice to have)
- Oracle (nice to have)
- Bash script (nice to have)
- Splunk (nice to have)
- Grafana (nice to have)
Opis stanowiska
O projekcie:
Poszukujemy doświadczonego Production Engineering Specialist, który będzie odpowiedzialny za utrzymanie i rozwój krytycznych systemów transakcyjnych działających w środowisku o wysokiej dostępności.
Rola łączy obszary Production Support, SRE oraz automatyzacji. Poszukujemy osoby, która potrafi diagnozować problemy produkcyjne end-to-end, rozumie zależności pomiędzy aplikacją, bazą danych i infrastrukturą oraz potrafi skutecznie przywracać stabilność systemów biznesowo krytycznych.
To stanowisko dla osób, które dobrze odnajdują się w dynamicznym środowisku produkcyjnym, mają doświadczenie w obsłudze incydentów oraz chcą realnie wpływać na niezawodność platform przetwarzających duże wolumeny transakcji.
Wymagania:
- Minimum 4 lata doświadczenia w obszarach Production Support, Application Support, SRE, Platform Engineering lub pokrewnych.- Bardzo dobra znajomość SQL.- Doświadczenie w pracy z relacyjnymi bazami danych produkcyjnymi oraz umiejętność analizy problemów na poziomie danych i zapytań bazodanowych.- Dobra znajomość Linux oraz swobodna praca w środowisku terminalowym.- Umiejętność tworzenia i utrzymywania skryptów automatyzujących w Bash, Python lub podobnych technologiach.- Doświadczenie w analizie incydentów produkcyjnych, troubleshootingu oraz prowadzeniu Root Cause Analysis (RCA).- Znajomość narzędzi monitoringu oraz analizy logów.- Umiejętność identyfikowania problemów wydajnościowych i proponowania optymalizacji dla aplikacji, baz danych lub środowiska produkcyjnego.- Znajomość procesów CI/CD oraz udział w procesach wdrożeniowych.- Praktyczne podejście do rozwiązywania problemów oraz umiejętność działania pod presją czasu.- Bardzo dobra znajomość języka polskiego i angielskiego.- Otwartość na pracę z biura w Krakowie 2 razy w tygodniu.
Mile widziane
- Doświadczenie z Kubernetes w zakresie monitorowania, diagnostyki i wsparcia aplikacji.- Doświadczenie w utrzymaniu systemów transakcyjnych, płatniczych lub innych środowisk mission critical.- Doświadczenie w środowiskach wysokiej dostępności (HA).- Udział w inicjatywach automatyzacyjnych, optymalizacyjnych lub związanych z poprawą niezawodności platform.- Doświadczenie w pracy zgodnie z praktykami Site Reliability Engineering.
Codzienne zadania:
- Obsługa i rozwiązywanie incydentów produkcyjnych.
- Analiza problemów oraz prowadzenie Root Cause Analysis (RCA).
- Monitorowanie stabilności, wydajności i dostępności systemów.
- Diagnostyka problemów obejmujących aplikacje, bazy danych, system operacyjny oraz środowisko kontenerowe.
- Udział w wdrożeniach nowych wersji oprogramowania oraz działaniach związanych z release management.
- Tworzenie i rozwijanie automatyzacji wspierających procesy operacyjne.
- Analiza logów, metryk i danych produkcyjnych.
- Współpraca z zespołami developerskimi przy identyfikacji i eliminacji problemów.
- Proponowanie oraz wdrażanie usprawnień zwiększających niezawodność i efektywność środowiska.
- Udział w działaniach post-mortem i inicjatywach poprawiających jakość usług.
Poszukujemy doświadczonego Production Engineering Specialist, który będzie odpowiedzialny za utrzymanie i rozwój krytycznych systemów transakcyjnych działających w środowisku o wysokiej dostępności.
Rola łączy obszary Production Support, SRE oraz automatyzacji. Poszukujemy osoby, która potrafi diagnozować problemy produkcyjne end-to-end, rozumie zależności pomiędzy aplikacją, bazą danych i infrastrukturą oraz potrafi skutecznie przywracać stabilność systemów biznesowo krytycznych.
To stanowisko dla osób, które dobrze odnajdują się w dynamicznym środowisku produkcyjnym, mają doświadczenie w obsłudze incydentów oraz chcą realnie wpływać na niezawodność platform przetwarzających duże wolumeny transakcji.
Wymagania:
- Minimum 4 lata doświadczenia w obszarach Production Support, Application Support, SRE, Platform Engineering lub pokrewnych.- Bardzo dobra znajomość SQL.- Doświadczenie w pracy z relacyjnymi bazami danych produkcyjnymi oraz umiejętność analizy problemów na poziomie danych i zapytań bazodanowych.- Dobra znajomość Linux oraz swobodna praca w środowisku terminalowym.- Umiejętność tworzenia i utrzymywania skryptów automatyzujących w Bash, Python lub podobnych technologiach.- Doświadczenie w analizie incydentów produkcyjnych, troubleshootingu oraz prowadzeniu Root Cause Analysis (RCA).- Znajomość narzędzi monitoringu oraz analizy logów.- Umiejętność identyfikowania problemów wydajnościowych i proponowania optymalizacji dla aplikacji, baz danych lub środowiska produkcyjnego.- Znajomość procesów CI/CD oraz udział w procesach wdrożeniowych.- Praktyczne podejście do rozwiązywania problemów oraz umiejętność działania pod presją czasu.- Bardzo dobra znajomość języka polskiego i angielskiego.- Otwartość na pracę z biura w Krakowie 2 razy w tygodniu.
Mile widziane
- Doświadczenie z Kubernetes w zakresie monitorowania, diagnostyki i wsparcia aplikacji.- Doświadczenie w utrzymaniu systemów transakcyjnych, płatniczych lub innych środowisk mission critical.- Doświadczenie w środowiskach wysokiej dostępności (HA).- Udział w inicjatywach automatyzacyjnych, optymalizacyjnych lub związanych z poprawą niezawodności platform.- Doświadczenie w pracy zgodnie z praktykami Site Reliability Engineering.
Codzienne zadania:
- Obsługa i rozwiązywanie incydentów produkcyjnych.
- Analiza problemów oraz prowadzenie Root Cause Analysis (RCA).
- Monitorowanie stabilności, wydajności i dostępności systemów.
- Diagnostyka problemów obejmujących aplikacje, bazy danych, system operacyjny oraz środowisko kontenerowe.
- Udział w wdrożeniach nowych wersji oprogramowania oraz działaniach związanych z release management.
- Tworzenie i rozwijanie automatyzacji wspierających procesy operacyjne.
- Analiza logów, metryk i danych produkcyjnych.
- Współpraca z zespołami developerskimi przy identyfikacji i eliminacji problemów.
- Proponowanie oraz wdrażanie usprawnień zwiększających niezawodność i efektywność środowiska.
- Udział w działaniach post-mortem i inicjatywach poprawiających jakość usług.
🔍 Dekoder Ogłoszenia
🔴
utrzymanie i rozwój krytycznych systemów transakcyjnych działających w środowisku o wysokiej dostępności
Może oznaczać pracę pod dużą presją czasu, z minimalnym marginesem błędu, gdzie awarie mają natychmiastowe i kosztowne konsekwencje.
🔴
Rola łączy obszary Production Support, SRE oraz automatyzacji.
Oczekuje się od Ciebie wykonywania zadań z różnych dziedzin, co może oznaczać brak jasno zdefiniowanych obowiązków i konieczność szybkiego przełączania się między zadaniami.
🔴
potrafi diagnozować problemy produkcyjne end-to-end
Oznacza to, że będziesz musiał rozumieć i analizować problemy na wszystkich poziomach systemu, od aplikacji po infrastrukturę, co może być bardzo czasochłonne.
🔴
dobrze odnajdują się w dynamicznym środowisku produkcyjnym
Może sugerować częste zmiany, nieprzewidziane sytuacje i potencjalnie konieczność pracy w niestandardowych godzinach.
🟢
chcą realnie wpływać na niezawodność platform przetwarzających duże wolumeny transakcji
Podkreśla wagę odpowiedzialności i potencjalnie stres związany z zapewnieniem stabilności systemów o kluczowym znaczeniu biznesowym.