Data Engineer bij BeFrank
Summary
Build and maintain a scalable data platform using Python, PySpark, and Delta Lake, creating production-grade pipelines and ensuring data quality for BeFrank’s financial services.
BeFrank is sinds een paar maanden live met haar Dataplatform. We zoeken een Data Engineer om het team compleet te maken en het platform verder te bouwen en verrijken.
Alle interne en externe communicatie is volledig in het Nederlands. Een vloeiende beheersing van het Nederlands in woord en schrift is daarom een hard verplichte pre‑condition voor het kantoor.
Wat je gaat doen
- Productiewaardige datapipelines schrijven in Python en PySpark volgens de medallion‑architectuur (bronze, silver, gold) op Delta Lake.
- Data ontsluiten uit verschillende bronsystemen: relationele databases, NoSQL databases, Blob/S3 storage, REST‑API’s, SFTP‑servers, etc.
- Tests schrijven op meerdere niveaus: unit tests, integratietests en BDD‑tests voor data‑transformaties, en Deze integreren in het CI/CD‑proces in Azure DevOps.
- Datakwaliteitsvalidaties ontwerpen en implementeren, zodat dataproblemen vroegtijdig worden gesignaleerd en afgevangen.
- Nauw samenwerken met data‑ en businessanalisten aan datamodellen en data‑producten die businesswaarde leveren.
- Zelfstandig technische oplossingen ontwerpen en implementeren binnen de software/cloud‑architectuur van het dataplatform.
- Actief bijdragen aan het kennisniveau binnen het engineering‑team, door nieuwe ideeën/tools te presenteren en code van collega‑engineers te reviewen.
Wat je meebrengt
- HBO/WO werk- en denkniveau met relevante werkervaring als data engineer.
- Ervaring met productiewaardige Python‑code (geen notebooks of low‑code, maar software met nette projectstructuur, herbruikbare componenten en foutafhandeling).
- Bewezen ervaring met het inrichten van een robuust, schaalbaar dataplatform met PySpark en Delta Lake, inclusief partitionering, schema‑evolutie, time travel en merge/upsert‑patronen op grootschalige datasets.
- Bekendheid met de medallion‑architectuur of gelijksoortige gelaagde dataplatform‑principes.
- Ervaring met het aansluiten van uiteenlopende bronsystemen en verschillende koppelingen ertussen.
- Sterke focus op datakwaliteit: ervaring met het inrichten van validaties en borgen van datakwaliteit in het proces.
- Ervaring met het schrijven van geautomatiseerde tests en het inrichten van CI/CD‑pijplijnen.
- Teamspeler die logische modellen en business‑definities weet te vertalen naar een gedegen fysiek datamodel.
- Ervaring met de Azure‑datastack (Synapse, Data Factory, Azure Functions) is een pré.
Arbeidsvoorwaarden
- Passend salaris op basis van 40 uur (Salarisschaal €4.665 – €6.665, afhankelijk van kennis en ervaring).
- Vaste eindejaarsuitkering.
- Prestatiebonus.
- Internetvergoeding.
- NS Business Card, kilometervergoeding of een (elektrische) Swapfiets.
- 29 vakantiedagen + 1 persoonlijke feestdag.
- Modern premievrij pensioen.
- Goede opleidingsmogelijkheden.
- Veel vrijheid en verantwoordelijkheid.
- Hybride werken vanuit ons duurzame kantoor in Amsterdam (minimaal 50 % op kantoor).