Data Scientist / NLP Engineer (Regex & Log Analysis)
⚲ Warszawa
16 800 - 25 200 PLN netto (B2B)
Wymagania
- Regular Expressions
Opis stanowiska
Data Scientist / NLP Engineer (Regex & Log Analysis)
W IT LeasingTeam łączymy najwyższej klasy ekspertów z prestiżowymi projektami technologicznymi. Obecnie poszukujemy analitycznego umysłu – Data Scientista / Inżyniera NLP, który dołączy do nowo budowanego zespołu wspierającego jednego z największych globalnych gigantów telekomunikacyjnych.
Szukamy osoby o ścisłym, matematycznym lub fizycznym zapleczu, dla której wyłapywanie skomplikowanych wzorców (pattern recognition) to naturalne środowisko. Jeśli fascynuje Cię analiza tekstu, algorytmika i potrafisz wycisnąć maksimum wydajności z wyrażeń regularnych (Regex), to rola dla Ciebie. Dołączysz do zespołu, w którym nie tylko będziesz zgłębiać możliwości modeli LLM, ale przede wszystkim pisać zaawansowane autorskie algorytmy do błyskawicznego przetwarzania milionów logów systemowych na sekundę.
Informacje organizacyjne:
•
Tryb pracy: W pełni zdalny.
• Forma współpracy: Kontrakt B2B (z możliwością wyboru wymiaru pracy: Full-time lub Part-time).
• Budżet: 100-150 PLN/h netto + VAT (z elastycznością w górę, jeśli posiadasz doświadczenie z narzędziami Big Data z sekcji "Mile widziane").
• Czas trwania: Współpraca długofalowa.
• Sektor: Telekomunikacja / R&D.
• Zespół: ~7 osób.
• Zakres zadań:
Projektowanie algorytmów: Tworzenie od podstaw skomplikowanych algorytmów i wysoce wydajnych wyrażeń regularnych (Regex) do ekstrakcji danych z surowych logów systemowych.
• Analiza i przetwarzanie tekstu (NLP): Zautomatyzowane przetwarzanie ogromnych wolumenów danych tekstowych przy utrzymaniu rygorystycznych wymogów wydajnościowych (latencja poniżej 5 sekund).
• Rozwój AI/LLM: Praca z nowoczesnymi modelami językowymi (LLM) i poszukiwanie nowych możliwości ich implementacji w architekturze projektu.
• Ewaluacja i optymalizacja: Rozwiązywanie zaawansowanych problemów analitycznych oraz ciągła optymalizacja kodu napisanego w języku Python.
Oczekiwania:
•
Wykształcenie ścisłe: Dyplom z matematyki, fizyki lub pokrewnych dziedzin (poszukujemy osób o silnych zdolnościach analitycznych).
• Programowanie: Biegłość w pisaniu czystego, zoptymalizowanego kodu w języku Python.
• Przetwarzanie tekstu i Regex: Bardzo silne doświadczenie w automatycznym przetwarzaniu tekstu (NLP), dogłębnej analizie danych tekstowych oraz mistrzowskie opanowanie Regular Expressions.
• Angielski: Płynna znajomość języka angielskiego (min. B2+) niezbędna do swobodnej pracy w międzynarodowym środowisku.
• Mile widziany stos technologiczny: Twoja kandydatura zyska ogromną przewagę (co przełoży się na stawkę startową), jeśli miałeś już styczność ze środowiskiem Big Data i narzędziami takimi jak: Spark, Hadoop, Kafka oraz stos ELK (Elasticsearch / Logstash / Kibana)
Oferujemy:
• Prestiż i wpływ: Praca w infrastrukturze IT o potężnej, międzynarodowej skali.
• Wyzwanie intelektualne: Przestrzeń do rozwiązywania nieszablonowych problemów algorytmicznych – u nas Twoja wiedza matematyczna będzie wykorzystywana w praktyce każdego dnia.
• Stabilność i elastyczność: Bezpieczny, długofalowy kontrakt z pełną swobodą pracy z dowolnego miejsca w Polsce.
W IT LeasingTeam łączymy najwyższej klasy ekspertów z prestiżowymi projektami technologicznymi. Obecnie poszukujemy analitycznego umysłu – Data Scientista / Inżyniera NLP, który dołączy do nowo budowanego zespołu wspierającego jednego z największych globalnych gigantów telekomunikacyjnych.
Szukamy osoby o ścisłym, matematycznym lub fizycznym zapleczu, dla której wyłapywanie skomplikowanych wzorców (pattern recognition) to naturalne środowisko. Jeśli fascynuje Cię analiza tekstu, algorytmika i potrafisz wycisnąć maksimum wydajności z wyrażeń regularnych (Regex), to rola dla Ciebie. Dołączysz do zespołu, w którym nie tylko będziesz zgłębiać możliwości modeli LLM, ale przede wszystkim pisać zaawansowane autorskie algorytmy do błyskawicznego przetwarzania milionów logów systemowych na sekundę.
Informacje organizacyjne:
•
Tryb pracy: W pełni zdalny.
• Forma współpracy: Kontrakt B2B (z możliwością wyboru wymiaru pracy: Full-time lub Part-time).
• Budżet: 100-150 PLN/h netto + VAT (z elastycznością w górę, jeśli posiadasz doświadczenie z narzędziami Big Data z sekcji "Mile widziane").
• Czas trwania: Współpraca długofalowa.
• Sektor: Telekomunikacja / R&D.
• Zespół: ~7 osób.
• Zakres zadań:
Projektowanie algorytmów: Tworzenie od podstaw skomplikowanych algorytmów i wysoce wydajnych wyrażeń regularnych (Regex) do ekstrakcji danych z surowych logów systemowych.
• Analiza i przetwarzanie tekstu (NLP): Zautomatyzowane przetwarzanie ogromnych wolumenów danych tekstowych przy utrzymaniu rygorystycznych wymogów wydajnościowych (latencja poniżej 5 sekund).
• Rozwój AI/LLM: Praca z nowoczesnymi modelami językowymi (LLM) i poszukiwanie nowych możliwości ich implementacji w architekturze projektu.
• Ewaluacja i optymalizacja: Rozwiązywanie zaawansowanych problemów analitycznych oraz ciągła optymalizacja kodu napisanego w języku Python.
Oczekiwania:
•
Wykształcenie ścisłe: Dyplom z matematyki, fizyki lub pokrewnych dziedzin (poszukujemy osób o silnych zdolnościach analitycznych).
• Programowanie: Biegłość w pisaniu czystego, zoptymalizowanego kodu w języku Python.
• Przetwarzanie tekstu i Regex: Bardzo silne doświadczenie w automatycznym przetwarzaniu tekstu (NLP), dogłębnej analizie danych tekstowych oraz mistrzowskie opanowanie Regular Expressions.
• Angielski: Płynna znajomość języka angielskiego (min. B2+) niezbędna do swobodnej pracy w międzynarodowym środowisku.
• Mile widziany stos technologiczny: Twoja kandydatura zyska ogromną przewagę (co przełoży się na stawkę startową), jeśli miałeś już styczność ze środowiskiem Big Data i narzędziami takimi jak: Spark, Hadoop, Kafka oraz stos ELK (Elasticsearch / Logstash / Kibana)
Oferujemy:
• Prestiż i wpływ: Praca w infrastrukturze IT o potężnej, międzynarodowej skali.
• Wyzwanie intelektualne: Przestrzeń do rozwiązywania nieszablonowych problemów algorytmicznych – u nas Twoja wiedza matematyczna będzie wykorzystywana w praktyce każdego dnia.
• Stabilność i elastyczność: Bezpieczny, długofalowy kontrakt z pełną swobodą pracy z dowolnego miejsca w Polsce.
🔍 Dekoder Ogłoszenia
🔴
wyłapywanie skomplikowanych wzorców (pattern recognition) to naturalne środowisko
Oczekuje się od Ciebie umiejętności znajdowania nietypowych lub trudnych do zidentyfikowania zależności w danych, co może oznaczać pracę z nieustrukturyzowanymi lub chaotycznymi danymi.
🔴
potrafisz wycisnąć maksimum wydajności z wyrażeń regularnych (Regex)
Może to oznaczać, że głównym narzędziem do analizy będzie Regex, a nie zaawansowane biblioteki NLP, co może być czasochłonne i ograniczone w skomplikowanych zadaniach.
🔴
pisać zaawansowane autorskie algorytmy do błyskawicznego przetwarzania milionów logów systemowych na sekundę
Chociaż brzmi to imponująco, może oznaczać konieczność tworzenia rozwiązań od zera w celu optymalizacji, zamiast korzystania z gotowych, sprawdzonych narzędzi.
🔴
z elastycznością w górę, jeśli posiadasz doświadczenie z narzędziami Big Data z sekcji "Mile widziane"
Budżet może być sztywny dla kandydatów bez doświadczenia w Big Data, a elastyczność dotyczy tylko wąskiej grupy osób.
🔴
nowo budowanego zespołu
Może oznaczać, że zespół jest w fazie organizacji, a procesy i struktura dopiero się kształtują, co może wiązać się z niepewnością i koniecznością adaptacji.