Data Engineer - Databricks H/F Visian

  • Paris - 75
  • Indépendant
  • Bac +2
  • Bac +3, Bac +4
  • Bac +5
  • Services aux Entreprises
  • Exp. 7 ans min.
Lire dans l'app

À noter sur ce job

Vous avez ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !

Détail du poste

Le besoin

Contexte

Positionné au sein de la DSI de l'entreprise, le Data Engineer intègrera l'équipe Conso Data qui traite les données de consommation des clients afin de les exposer sur les canaux digitaux.

L'équipe est Agile, composée d'autres Data Engineers, et intégrée à un Train SAFe synchronisé avec d'autres Trains et équipes Data.

Missions

  • Être force de proposition et participer à la conception des solutions techniques en collaboration avec les membres de l'équipe.

  • Comprendre les enjeux métiers afin de concevoir des solutions répondant aux besoins fonctionnels.

  • Participer aux cérémonies Agile SAFe (PI Planning, macro-chiffrage, refinements, rétrospectives, etc.).

  • Concevoir et faire évoluer les architectures de données basées sur l'approche Databricks Medallion Architecture (Bronze, Silver, Gold).

  • Garantir la qualité, la fiabilité et la performance des traitements de données en production (Jobs Databricks et APIs).

  • Contribuer à l'amélioration continue de la plateforme en proposant des optimisations techniques, des bonnes pratiques et des innovations.

  • Concevoir, développer et maintenir des pipelines de données (ETL) pour les flux d'intégration et les flux métiers.

  • Mettre en oeuvre et orchestrer les traitements de données à l'aide des outils Databricks.

  • Modéliser les données dans les tables Delta Lake en appliquant les bonnes pratiques de partitionnement, indexation, optimisation et gouvernance.

  • Optimiser les performances des traitements Databricks (Spark, Delta Lake, gestion des coûts et du temps d'exécution).

  • Assurer le développement, les tests et le déploiement des composants techniques via des processus CI/CD.

  • Concevoir, développer et maintenir des APIs permettant l'exposition et la consommation des données.

  • Mettre en place des mécanismes de contrôle qualité des données (Data Quality), de monitoring et d'alerting.

  • Identifier, analyser et résoudre les incidents de production tout en assurant le suivi des actions correctives.

  • Rédiger et maintenir la documentation technique des solutions mises en oeuvre.

  • Accompagner les équipes dans l'adoption des bonnes pratiques Data Engineering.

Outils & Environnement

  • Python, SQL

  • Spark, PySpark, DBUtils

  • FastApi, Pytest

  • Databricks, Unity Catalog

  • Airflow (migration vers Databricks Workflow)

  • AWS (Lambda, Secret Manager, Bucket S3, ECS)

  • Git et gestion du versioning

  • Déploiement pipeline CI/CD

Conditions de travail

  • Modalité de la prestation : Temps plein

  • Plage de travail : Heure ouvrée

  • Options de renouvellement possible : Oui, 12 mois (la durée totale de la mission ne peut pas excéder 3 ans)

Compétences à évaluer

  • Conception et développement de pipelines de données

  • Connaissance des principes d'API REST et des architectures orientées services

  • Solides connaissances en modélisation de données, performance et qualité des données

  • Analyses & correction d'anomalies

  • Connaissance Cloud AWS

  • Maîtrise de Python, SQL et des bibliothèques d'analyse de données (DButils, PySpark, Boto3)

  • Maîtrise des configurations ressources Databricks AWS

  • Expérience de Techlead

  • La gestion de streaming de données en temps réel serait un plus

Le profil recherché

Profil recherché

  1. 7 années d'expérience avancée en conception et développement de pipelines de données
  2. 7 années d'expérience avancée en connaissance Cloud AWS
  3. 7 années d'expérience avancée en connaissance des principes d'API REST et des architectures orientées services
  4. 7 années d'expérience avancée en expérience de Techlead
  5. 7 années d'expérience avancée en gestion de streaming de données en temps réel (serait un plus)
  6. 7 années d'expérience avancée en maîtrise des configurations ressources Databricks AWS
  7. 7 années d'expérience avancée en maîtrise de Python, SQL et des bibliothèques d'analyse de données (DButils, PySpark, Boto3)
  8. 7 années d'expérience avancée en solides connaissances en modélisation de données, performance et qualité des données

Infos complémentaires

Taux journalier :Salaire selon profil

Publiée le 01/09/2026 - Réf : e576e5dcdc6cb8122163509781c81ca9

Postuler
Créez votre compte
Hellowork et postulez

sur le site du partenaire !

Voir plus d'offres
Les sites
L'emploi
  • Offres d'emploi par métier
  • Offres d'emploi par ville
  • Offres d'emploi par entreprise
  • Offres d'emploi par mots clés
L'entreprise
  • Qui sommes-nous ?
  • On recrute
  • Accès client
Les apps
Nous suivre sur :
Informations légales CGU Politique de confidentialité Gérer les traceurs Accessibilité : non conforme Aide et contact