Senior Software Engineer
Summary
Senior Software Engineer builds and maintains a biomedical Knowledge Graph in Neo4j, integrating and validating heterogeneous data sources with Python pipelines for downstream AI use.
Kim jest H2B Group?
Jesteśmy firmą konsultingową, która pomaga klientom w automatyzacji procesów biznesowych przy pomocy AI, a specjalistom IT rozwijać karierę w modelu B2B. Oferujemy projekty z branż takich jak fintech, medtech, edutech czy automatyka przemysłowa. Dzięki ścisłej współpracy wspieramy rozwój naszych klientów poprzez dostarczanie szybkich i mierzalnych efektów, jednocześnie zapewniając specjalistom IT możliwości rozwoju kariery i zdobywania cennego doświadczenia.
Dlaczego warto z nami współpracować?
✨ Elastyczność – Wybierasz projekty dopasowane do swoich umiejętności i zainteresowań, z możliwością zmiany w ramach naszej firmy lub grupy Euvic, której jesteśmy częścią.
💡 Przejrzystość – Masz jasne zasady współpracy i pełną transparentność wynagrodzenia oraz warunków.
🚀 Szybkość działania – Dzięki naszej efektywności szybko znajdziesz lub zmienisz projekt, który idealnie odpowiada Twoim kompetencjom.
🌟 Możliwość rozwoju – Pracujesz przy innowacyjnych projektach, rozwijając kluczowe kompetencje i zdobywając cenne doświadczenie.
Do projektu naszego klienta poszukujemy osoby na stanowisko Senior Software Engineer (Python)
Zakres obowiązków na tym stanowisku:
Odpowiedzialność za jakość danych w Knowledge Graph – definiowanie i wdrażanie mechanizmów walidacji danych, provenance tracking oraz metryk jakości.
Integracja danych pochodzących z wielu wewnętrznych i zewnętrznych źródeł biomedycznych.
Normalizacja, harmonizacja oraz ujednolicanie danych i identyfikatorów pochodzących z różnych źródeł.
Rozwój i utrzymanie Knowledge Graph opartego na Neo4j.
Projektowanie i rozwój schematu oraz modelu danych w Neo4j.
Optymalizacja zapytań Cypher oraz dbanie o wydajność rozwiązania.
Rozwój i utrzymanie pipeline'ów danych oraz zapewnienie ich niezawodności.
Bezpośrednia współpraca z dostawcami danych w celu rozwiązywania problemów związanych ze schematami, identyfikatorami oraz spójnością danych.
Przygotowywanie danych do wykorzystania w rozwiązaniach AI, analityce oraz inicjatywach takich jak Blindspot Analysis.
Współpraca z research scientists, data scientists oraz software engineers w celu przekładania potrzeb naukowych na stabilne i skalowalne rozwiązania danych.
Wymagania:
Bardzo dobra znajomość Pythona, szczególnie w kontekście data engineeringu oraz tworzenia pipeline'ów danych.
Praktyczne doświadczenie z Neo4j.
Bardzo dobra znajomość Cypher, projektowania schematów oraz optymalizacji zapytań.
Doświadczenie w integracji wielu heterogenicznych źródeł danych biomedycznych.
Bardzo dobra znajomość praktyk związanych z data quality w środowiskach produkcyjnych.
Doświadczenie w definiowaniu walidacji danych, mierników jakości oraz śledzeniu pochodzenia danych.
Doświadczenie we współpracy z dostawcami danych oraz rozwiązywaniu problemów dotyczących schematów, identyfikatorów i spójności danych.
Znajomość standardów oraz identyfikatorów stosowanych w danych biomedycznych.
Umiejętność współpracy z interdyscyplinarnymi zespołami naukowymi i technicznymi.
Co oferujemy?
Pracę zdalną – elastyczność, która pozwala pracować z każdego zakątka świata!
Ciekawe projekty – dobierane zgodnie z Twoimi umiejętnościami i zainteresowaniami, dające możliwość pracy nad innowacyjnymi rozwiązaniami.
Umowa B2B bez zapisu o wyłączności – współpracuj z nami na swoich zasadach.
Rozwój zawodowy – praca z najnowszymi technologiami i w zróżnicowanych projektach gwarantuje stały rozwój.