Pracuj.pl Praca zdalna Senior

HPC Engineer

7bulls.com Sp. z o.o.

⚲ Warszawa, Śródmieście

160–180 zł netto (+ VAT) / godz.

Wymagania

  • TensorFlow
  • PyTorch
  • Apptainer
  • Singularity
  • Docker
  • Kubernetes

Opis stanowiska

Nasze wymagania:
Wykształcenie wyższe (licencjackie lub magisterskie) w obszarze informatyki, inżynierii obliczeniowej, matematyki stosowanej, fizyki lub pokrewnych dziedzin nauk ścisłych.
Silne, praktyczne doświadczenie w pracy z zadaniami HPC opartymi na MPI (np. symulacje CFD, FEA, solvery numeryczne).
Doświadczenie w obszarze obliczeń GPU (znajomość CUDA, NCCL, TensorFlow, PyTorch).
Biegłą znajomość środowisk Linux oraz systemów kolejkowania zadań (Slurm, PBS lub pokrewne).
Znajomość technologii kontenerowych wykorzystywanych w środowiskach HPC (Apptainer/Singularity, Docker, Kubernetes).
Doskonałe umiejętności diagnostyczne (troubleshooting) w analizie systemów rozproszonych i obliczeń równoległych.
Świetnie rozwinięte umiejętności komunikacyjne, pozwalające na efektywne wsparcie merytoryczne i prowadzenie szkoleń dla użytkowników końcowych.

Mile widziane:
Doświadczenie w realizacji hybrydowych symulacji łączących zasoby CPU + GPU.
Znajomość równoległych systemów plików (np. Lustre, BeeGFS, Spectrum Scale).
Praktyczna wiedza z zakresu obsługi narzędzi do profilowania wydajności i debugowania kodu.
Wcześniejsze doświadczenie we wspieraniu i utrzymaniu potoków danych (pipelines) AI/ML na architekturze HPC.
Wiedza dziedzinowa w co najmniej jednym obszarze naukowym lub inżynieryjnym (np. mechanika strukturalna, fizyka obliczeniowa, CFD, AI/ML).

O projekcie:
W 7bulls łączymy zaawansowaną innowację inżynierską z realnymi potrzebami rynku. Wspólnie z partnerem rozwijamy nową generację infrastruktury High Performance Computing (HPC), która umożliwi wdrażanie, optymalizację i uruchamianie najbardziej wymagających zadań obliczeniowych. Szukamy utalentowanego Inżyniera HPC, który stanie się kluczowym łącznikiem między zaawansowaną infrastrukturą systemową a użytkownikami końcowymi (naukowcami, inżynierami oraz specjalistami ds. sztucznej inteligencji).
Twoim głównym zadaniem będzie dbanie o to, aby realizowane przez klientów zadania obliczeniowe osiągały maksymalną wydajność, skalowalność i stabilność.

Zakres obowiązków:
Wsparcie i aktywizacja użytkowników (User Enablement):
• Pomoc klientom w konfiguracji, instalacji i uruchamianiu zadań HPC (w środowiskach bare-metal oraz skonteneryzowanych).
• Dostarczanie technicznego wsparcia przy uruchamianiu symulacji CFD, FEA oraz innych “tightly coupled” obliczeń numerycznych.
• Wspieranie zespołów AI/ML w obszarze trenowania modeli, wnioskowania (inference), fine-tuningu oraz zadań rozproszonych.
• Pomoc użytkownikom w tworzeniu i optymalizacji niestandardowych obrazów oraz kontenerów dedykowanych zadaniom AI.
Optymalizacja wydajności (Performance Optimization):
• Przeprowadzanie testów wydajnościowych (benchmarking) i tuning aplikacji w celu maksymalnego wykorzystania potencjału procesorów CPU i GPU.
• Optymalizacja skalowania aplikacji MPI na potrzeby obliczeń rozproszonych.
• Doradztwo w zakresie strategii zrównoleglenia obliczeń, efektywnego zarządzania pamięcią oraz wydajności sieci wewnętrznej (interconnect).
Integracja systemów i narzędzia:
• Praca z systemami kolejkowania zadań (np. Slurm) w celu konfiguracji i optymalizacji procesów obliczeniowych.
• Integracja popularnych frameworków AI/ML (TensorFlow, PyTorch, JAX) z istniejącą infrastrukturą HPC.
• Wykorzystywanie narzędzi do profilowania i debugowania (np. Intel VTune, NVIDIA Nsight, Perf) w celu diagnozowania wąskich gardeł i problemów z wydajnością.
Szkolenia i dokumentacja:
• Tworzenie przejrzystych przewodników, samouczków oraz baz dobrych praktyk dla użytkowników platformy HPC.
• Prowadzenie indywidualnych oraz grupowych sesji szkoleniowych dla klientów z zakresu optymalnego korzystania z systemu.
Współpraca:
• Ścisła współpraca z zespołami odpowiedzialnymi za infrastrukturę w celu dostosowania konfiguracji systemowych do specyfiki uruchamianych zadań.
• Współpraca z naukowcami, badaczami i praktykami AI w celu przełożenia ich wymagań projektowych na efektywne procesy obliczeniowe (workflows).

Oferujemy:
Trwałą i stabilną współpracę.
Pracę zdalną lub w biurze.
Czas pracy dostosowany do Twoich potrzeb.
Lektoraty z języka angielskiego.
Prywatną opiekę medyczną.
Indywidualne i elastyczne podejście do ludzi oraz ich sytuacji.

🔍 Dekoder Ogłoszenia

🔴
Silne, praktyczne doświadczenie w pracy z zadaniami HPC opartymi na MPI
Oczekuje się, że kandydat nie tylko zna MPI, ale potrafi samodzielnie rozwiązywać problemy i optymalizować złożone symulacje.
🔴
Doskonałe umiejętności diagnostyczne (troubleshooting) w analizie systemów rozproszonych i obliczeń równoległych.
Kandydat musi być w stanie samodzielnie i szybko identyfikować oraz rozwiązywać skomplikowane problemy techniczne w środowisku HPC.
🔴
Świetnie rozwinięte umiejętności komunikacyjne, pozwalające na efektywne wsparcie merytoryczne i prowadzenie szkoleń dla użytkowników końcowych.
Oprócz pracy technicznej, kandydat będzie musiał aktywnie komunikować się z użytkownikami, tłumaczyć złożone zagadnienia i szkolić.
🔴
Wcześniejsze doświadczenie we wspieraniu i utrzymaniu potoków danych (pipelines) AI/ML na architekturze HPC.
To nie tylko znajomość AI/ML, ale umiejętność integracji i utrzymania tych procesów w specyficznym, wysokowydajnym środowisku obliczeniowym.
🔴
Wiedza dziedzinowa w co najmniej jednym obszarze naukowym lub inżynieryjnym
Oczekuje się, że kandydat rozumie kontekst naukowy lub inżynieryjny zadań, które będzie wspierał, a nie tylko samą technologię HPC.