Point your AI agent at freehire and let it find you a job.

Get the CLI →

Golden Bees

NewBe an early applicant

Data Engineer Hadoop / PySpark — Datalake d'un grand groupe bancaire H/F (CDI)

Posted
Discussion

Summary

Permanent data engineer role in Paris building and running the Hadoop data lake of a major banking group's tech & operations division: designing new data ingestions, maintaining PySpark pipeline tooling, and working closely with production and DevOps teams. Core stack: Hadoop, PySpark, Hive, Python, SQL, Git, Jenkins, with optional GCP/BigQuery exposure; English used daily.

Free-Work est une plateforme qui s'adresse à tous les professionnels des métiers de l'informatique.

Vérifiez attentivement tous les documents de candidature associés avant de cliquer sur le bouton "Postuler" au bas de cette description.

Ses contenus et son jobboard IT sont mis à disposition 100% gratuitement pour les indépendants et les salariés du secteur.
Vous aimez les plateformes de données qui tournent vraiment en production ? Rejoignez l'équipe qui fait vivre le datalake des fonctions Technologies & Opérations d'un grand groupe bancaire.

La DSI fournit aux directions technologiques, aux opérations et à la banque de proximité les applications et les données dont elles ont besoin au quotidien. Le datalake Hadoop en est une pièce centrale : il alimente le pilotage et les usages analytiques de plusieurs directions. Vous intervenez en lien direct avec la production applicative et l'équipe DevOps, au sein d'une équipe IT internationale.

Vos principales missions :

Concevoir et mettre en production de nouvelles ingestions de données : collecte, préparation, transformation.

Maintenir et faire évoluer les outils de gestion des pipelines de données (PySpark, shell scripting).

Porter auprès de l'équipe DevOps les évolutions nécessaires de la plateforme.

Rédiger des spécifications techniques claires et exploitables par l'équipe.

Ce que la mission vous apporte :

Un datalake en production, avec de vrais volumes et de vrais utilisateurs métier.

Une équipe internationale : l'anglais est utilisé au quotidien.

Une ouverture vers le cloud (GCP / BigQuery) pour qui veut élargir sa stack.

Environnement technique : Hadoop, PySpark, Spark, Hive, Python, SQL, Git, Jenkins, Jira, Unix / Linux ? Scrum.
Data Engineer de 3 à 6 ans d'expérience, à l'aise sur une plateforme Hadoop en production. Excellente maîtrise de Hadoop, du développement Python / PySpark et de Hive ; bonne connaissance de SQL, Git, Jenkins, Jira et du shell scripting Unix / Linux. Pratique de Scrum. xzewmjt Anglais courant, écrit et oral. Atouts : Indexima, Alteryx, Altair, GCP / BigQuery, bibliothèques Python orientées API.

Skills

Apply

See also

Data Engineering jobs by country — openings, pay and top skills →

Tailor your CV for this role?

We couldn't check your fit for this role — add a CV to your profile to see it next time.

A new version of freehire is available