Data Engineer, Platform (F/M)
Summary
Data Engineer on the Platform team at Gens de Confiance, deploying and maintaining the data platform in Nantes: reliable event-ingestion pipelines and data warehouse on AWS (Redshift, Lambda, Kinesis) with Airflow and dbt, plus analytics integrations (Amplitude, Metabase) and support for product teams' AI and data-access needs.
Contexte
La data est au coeur de la stratégie de Gens de Confiance. Elle permet de prendre des décisions au quotidien autour de notre produit afin d’améliorer l’expérience utilisateur et de proposer de nouveaux services et produits liés à la confiance.
Notre plateforme de données se compose notamment d’un Data Warehouse et d’une pipeline d’ingestion d’événements. Son importance chez Gens de Confiance ne fait que se renforcer et de nouveaux sujets émergent autour des LLMs et des automatisations No-Code.
Nous recrutons un(e) nouveau(elle) Data Engineer afin de renforcer l’équipe Data et travailler sur le déploiement, l’amélioration et la maintenance de la plateforme data (tracking, pipeline d’ingestion, intégration avec des solutions telles qu’Amplitude, Metabase, Datdog, etc.).
Missions
Intégré à l’équipe Platforme, ton enjeu est de fournir un accès stable à la donnée chez GDC.
Pour ce faire tes principales missions sont de :
- Déployer et maintenir des pipelines capables de traiter un volume important de données de façon fiable tout en garantissant leur sécurité.
- Accompagner les équipes produit et tech dans la prise en main de cette plateforme, et renforcer l’ownership et l’adoption des outils.
- Permettre aux équipes produit de mettre en place, évaluer et maintenir des solutions d’IA.
- Intégrer ou développer des outils d’accès et de visualisation de la donnée (Amplitude, Metabase, etc.).
- Etre force de proposition et mettre en place des améliorations dans le processus de développement (CI, tests, monitoring, déploiement, etc.).
- Rassembler et prioriser les besoins data des équipes Marketing, Produit, Product Ops et du Comité de pilotage.
- Mesurer et améliorer les métriques non fonctionnelles du pipeline de données (disponibilité, taux d’erreur, latence, …).
- Prendre en compte le contexte réglementaire quant à la récolte et à l’accès aux données (RGPD).
La stack technique
- Environnement : AWS (Redshift, Lambda, S3, Kinesis, EventBridge, etc.)
- Data stack : Airflow, dbt
- Langages : Python, SQL, Go
- Analytics : Metabase, Amplitude
- DevOps & Infra: GitHub (CI/CD), Terraform
- IA : Outils d’assistance au code par IA (Codex, Claude, etc.)
Idéalement, tu es de formation ingénieur ou équivalent.Tu disposes d’une expérience d’au moins 4 ans dans l’informatique.Tu maîtrises au moins un langage de programmation (Python de préférence, Go, JavaScript, PHP) et tu es sensible aux bonnes pratiques de qualité de code..Tu parles le SQL et tu maîtrises les concepts et la gestion des bases de données relationnelles et NoSQL.Tu as développé et maintenu des pipelines de données en production, et tu as idéalement mis en place ou contribué à une Modern Data Stack (Airflow, dbt, process ELT/ETL, Data Mesh, etc.).Tu as de l’expérience avec un fournisseur de services cloud, idéalement AWS (Lambda, Kinesis, Redshift, etc.)Tu es à l’aise avec un environnement de startup dynamique, de multiples priorités à organiser - bref, tu aimes la gestion de projet et l’amélioration continue.Tu es curieux, et cherches en permanence à améliorer l’existant et à partager tes trouvailles.Tu as le sens du service et est à l’écoute des feedbacks internes sur la plateforme data.
Ton quotidienUn bureau lumineux au cœur de Nantes.Une équipe à taille humaine.Des horaires flexibles.Du matériel de compet’.Participer à une aventure au sein d’une Scale-up en pleine croissance, dans l’économie circulaire !