Data Engineer - Aws Databricks Pyspark Sustainability H/F Naxo
- Lille - 59
- Indépendant
- Bac +2
- Bac +3, Bac +4
- Bac +5
- Services aux Entreprises
À noter sur ce job
Vous avez ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !
Détail du poste
Le besoin
Contexte
Mission longue basée à Lille (hybride). Organisation engagée dans une transformation visant à tracer, mesurer et optimiser l'impact environnemental des produits. L'équipe Planet est responsable de la construction et de la fiabilisation des données Sustainability, Circular Economy et Workshop.
Missions
En tant que Data Engineer, vous travaillerez sur deux produits gérés par l'équipe :
- Service : prolonger la vie des produits en structurant les données de l'ensemble des flux circulaires.
- Sustainability : mesurer et réduire l'empreinte carbone de chaque produit depuis la conception jusqu'à l'impact en rayon.
Responsabilités :
- Implémenter des solutions, à partir des règles fonctionnelles établies par le Product Manager / Data Owner.
- Documenter les règles de qualité décrites dans Collibra au préalable pour valider les datasets.
- Partir des templates génériques pour construire des pipelines scalables de données structurées.
- Transformer la stack legacy vers la nouvelle stack recommandée par les équipes de la Data Platform.
- Répondre aux questions des utilisateurs ainsi que de l'équipe de datavisualisation sur les données mises à disposition.
- Intervenir sur l'ensemble des flux de l'équipe et documenter les flux implémentés.
- Contribuer à l'amélioration des bonnes pratiques de développement (Mob programming, Test Driven Development, ...) et à la communauté de data engineers.
Outils & Environnement
- Environnement Big Data Amazon Web Services (AWS) : S3, CodeArtefact, ECR, etc.
- Pipelines de données : DBT, PySpark
- Ordonnancement : Airflow
- Plateforme : Databricks
- Langages : Python, SQL
- Outils de gouvernance des données : Collibra
Conditions de travail
- Localisation : Lille (mode hybride)
- Durée : mission longue
Abonnez-vous à la page NaxoTech sur LinkedIn pour découvrir nos offres régulières :
👉
Le profil recherché
Profil recherché
- Expérience sur l'environnement Big Data d'Amazon Web Services (AWS) avec maîtrise de ses composants (S3, CodeArtefact, ECR) et optimisation de leurs performances
- Expérience dans l'implémentation de pipelines de données (DBT, PySpark)
- Expérience dans la mise en place de l'ordonnancement via Airflow
- Connaissances sur Databricks
- Développement en Python
- Connaissances en modélisation de données
- Niveau Avancé en Spark, AWS S3, Python, PySpark, Databricks
- Niveau Confirmé en langage SQL
Infos complémentaires
Publiée le 08/10/2026 - Réf : 152a6fc97f752298dc00c788f04ff2d9