Data Engineer Hadoop / PySpark - Plateforme Data (H/F)
Rejoignez-nous!
Nous recherchons un(e) Data Engineer Hadoop / PySpark pour intervenir sur une plateforme Data stratégique et contribuer aux évolutions d’un datalake.
Vous serez en charge de la mise en œuvre technique de nouvelles ingestions de données, des traitements de préparation et de transformation, ainsi que de la maintenance et de l’évolution des pipelines de données.
Vous travaillerez en étroite collaboration avec les équipes de production applicative et DevOps, dans un environnement Agile, dynamique et international.
Ce que vous ferez:
Mettre en œuvre de nouvelles ingestions de données au sein du datalake.
Développer les traitements de préparation et de transformation des données.
Maintenir et faire évoluer les pipelines de données en PySpark et shell scripting.
Développer et optimiser les traitements de données sur la plateforme Hadoop.
Exploiter Hive et SQL pour la manipulation, la transformation et l’analyse des données.
Collaborer avec l’équipe DevOps et lui adresser les demandes relatives aux évolutions de la plateforme.
Participer à l’intégration et au déploiement des évolutions via les outils de gestion de code source et d’intégration continue.
Rédiger des spécifications techniques claires et précises.
Analyser et résoudre des problématiques techniques complexes liées aux traitements et pipelines de données.
Contribuer à l’amélioration continue de la plateforme et être force de proposition sur les solutions et technologies à mettre en œuvre.
Votre positionnement vous permettra d’intervenir au cœur d’une plateforme Data stratégique, en interaction avec des équipes techniques multidisciplinaires et internationales.