Data Engineer - Databricks H/F Visian
- Paris - 75
- Indépendant
- Bac +2
- Bac +3, Bac +4
- Bac +5
- Services aux Entreprises
- Exp. 7 ans min.
À noter sur ce job
Vous avez ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !
Détail du poste
Le besoin
Contexte
Positionné au sein de la DSI de l'entreprise, le Data Engineer intègrera l'équipe Conso Data qui traite les données de consommation des clients afin de les exposer sur les canaux digitaux.
L'équipe est Agile, composée d'autres Data Engineers, et intégrée à un Train SAFe synchronisé avec d'autres Trains et équipes Data.
Missions
Être force de proposition et participer à la conception des solutions techniques en collaboration avec les membres de l'équipe.
Comprendre les enjeux métiers afin de concevoir des solutions répondant aux besoins fonctionnels.
Participer aux cérémonies Agile SAFe (PI Planning, macro-chiffrage, refinements, rétrospectives, etc.).
Concevoir et faire évoluer les architectures de données basées sur l'approche Databricks Medallion Architecture (Bronze, Silver, Gold).
Garantir la qualité, la fiabilité et la performance des traitements de données en production (Jobs Databricks et APIs).
Contribuer à l'amélioration continue de la plateforme en proposant des optimisations techniques, des bonnes pratiques et des innovations.
Concevoir, développer et maintenir des pipelines de données (ETL) pour les flux d'intégration et les flux métiers.
Mettre en oeuvre et orchestrer les traitements de données à l'aide des outils Databricks.
Modéliser les données dans les tables Delta Lake en appliquant les bonnes pratiques de partitionnement, indexation, optimisation et gouvernance.
Optimiser les performances des traitements Databricks (Spark, Delta Lake, gestion des coûts et du temps d'exécution).
Assurer le développement, les tests et le déploiement des composants techniques via des processus CI/CD.
Concevoir, développer et maintenir des APIs permettant l'exposition et la consommation des données.
Mettre en place des mécanismes de contrôle qualité des données (Data Quality), de monitoring et d'alerting.
Identifier, analyser et résoudre les incidents de production tout en assurant le suivi des actions correctives.
Rédiger et maintenir la documentation technique des solutions mises en oeuvre.
Accompagner les équipes dans l'adoption des bonnes pratiques Data Engineering.
Outils & Environnement
Python, SQL
Spark, PySpark, DBUtils
FastApi, Pytest
Databricks, Unity Catalog
Airflow (migration vers Databricks Workflow)
AWS (Lambda, Secret Manager, Bucket S3, ECS)
Git et gestion du versioning
Déploiement pipeline CI/CD
Conditions de travail
Modalité de la prestation : Temps plein
Plage de travail : Heure ouvrée
Options de renouvellement possible : Oui, 12 mois (la durée totale de la mission ne peut pas excéder 3 ans)
Compétences à évaluer
Conception et développement de pipelines de données
Connaissance des principes d'API REST et des architectures orientées services
Solides connaissances en modélisation de données, performance et qualité des données
Analyses & correction d'anomalies
Connaissance Cloud AWS
Maîtrise de Python, SQL et des bibliothèques d'analyse de données (DButils, PySpark, Boto3)
Maîtrise des configurations ressources Databricks AWS
Expérience de Techlead
La gestion de streaming de données en temps réel serait un plus
Le profil recherché
Profil recherché
- 7 années d'expérience avancée en conception et développement de pipelines de données
- 7 années d'expérience avancée en connaissance Cloud AWS
- 7 années d'expérience avancée en connaissance des principes d'API REST et des architectures orientées services
- 7 années d'expérience avancée en expérience de Techlead
- 7 années d'expérience avancée en gestion de streaming de données en temps réel (serait un plus)
- 7 années d'expérience avancée en maîtrise des configurations ressources Databricks AWS
- 7 années d'expérience avancée en maîtrise de Python, SQL et des bibliothèques d'analyse de données (DButils, PySpark, Boto3)
- 7 années d'expérience avancée en solides connaissances en modélisation de données, performance et qualité des données
Infos complémentaires
Publiée le 01/09/2026 - Réf : e576e5dcdc6cb8122163509781c81ca9