Site Reliability Engineer (SRE)
Do uzgodnienia
Wymagania
- doświadczenie jako Site Reliability Engineer z mocnym tłem backendowym w Node.js i TypeScript
- własność observability kluczowych ścieżek produktowych i użytkownika
- definiowanie i utrzymanie SLI/SLO oraz metryk, dashboardów i alertów
- pierwszy responder incydentów P0/P1, w tym poza godzinami pracy
- samodzielna analiza sygnałów produkcyjnych i rozpoczęcie mitygacji przed eskalacją
- udział w triage, mitygacji i postmortemach
- praca w rozproszonym, autonomicznym zespole
Opis stanowiska
SRE osadzony w zespole produktowym aplikacji randkowej (Feeld) — odpowiadasz za observability kluczowych ścieżek użytkownika, definiujesz SLI/SLO, budujesz metryki, dashboardy i alerty oraz jesteś pierwszym responderem incydentów P0/P1, w tym poza godzinami pracy. Zespół pracuje w małych, autonomicznych squadach rozproszonych po Europie i USA. Dobra oferta dla doświadczonego backendowca (Node.js/TypeScript), który chce przejść w stronę reliability. Uwaga: możesz być jedynym SRE w swoim squadzie — duża odpowiedzialność i potencjalnie ograniczone wsparcie; fragment ogłoszenia jest urwany.
🔍 Dekoder Ogłoszenia
🔴
You will be embedded within a product squad and take ownership of the reliability and observability of critical user journeys.
Może oznaczać, że będziesz jedynym SRE w zespole produktowym, co wiąże się z dużą odpowiedzialnością i potencjalnie brakiem wsparcia.
🔴
The team works in small, autonomous product squads, each responsible for a specific area of the product and critical user journeys.
Autonomia może oznaczać brak jasnych wytycznych lub procesów, a także konieczność samodzielnego podejmowania decyzji w niepewnych sytuacjach.
🔴
From a technical perspective, the team is focused on building reliable, observable systems that allow engineers to identify issues early, understand their impact and respond quickly when incidents occur.
Choć brzmi to profesjonalnie, może sugerować, że obecne systemy nie są wystarczająco niezawodne i obserwowane, a Ty będziesz musiał to naprawić od podstaw.
🔴
An important part of the role is being able to interpret production signals, identify when something is
Fragment jest urwany, co może sugerować niedopracowane ogłoszenie lub brak pełnej jasności co do zakresu obowiązków związanych z analizą sygnałów produkcyjnych.