Data Engineer Databricks Senior H/F DGTL Performance
- Paris - 75
- CDI
- Télétravail partiel
- Bac +2
- Bac +3, Bac +4
- Bac +5
- Secteur informatique • ESN
À noter sur ce job
Vous avez ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !
Détail du poste
Vous rejoindrez une mission au sein d'une équipe projet dédiée à la modernisation et l'optimisation des infrastructures data d'un grand groupe. Cette mission repose sur l'expertise Databricks et requiert une maîtrise avancée des technologies big data et du traitement distribué de données à grande échelle.
Vous serez impliqué dans la conception, le développement et la maintenance d'une architecture data robuste et sécurisée. Votre rôle consistera à garantir la collecte, le stockage et l'exploitation efficace des flux de données en répondant aux enjeux métier de l'organisation. Vous participerez à la création d'un socle technique solide, en assurant les meilleures pratiques en matière de performance, de scalabilité et de sécurité des données.
L'environnement technique s'appuie sur des technologies cloud et big data modernes. Vous travaillerez dans une méthodologie agile, en étroite collaboration avec les équipes data science, analytics et infrastructure. Vous serez responsable de l'optimisation des pipelines de données, de la gestion des environnements de calcul distribué et du respect des standards d'architecture.
Responsabilités :
- Concevoir et implémenter des architectures data scalables et sécurisées sur Databricks
- Développer et optimiser des pipelines ETL complexes en PySpark
- Assurer la collecte, la transformation et l'intégration des flux de données hétérogènes
- Garantir la qualité, la performance et la fiabilité des infrastructures data
- Participer à la définition des standards techniques et des bonnes pratiques d'équipe
- Collaborer avec les équipes métier et data science pour traduire les besoins en solutions techniques
- Assurer la sécurité, la gouvernance et la conformité des données
- Documenter et maintenir les solutions mises en place
- Contribuer à l'évolution continue de la stack technologique
Télétravail : 2 jours par semaine
Localisation : Paris
Profil :
Indispensables :
- Expertise confirmée en Databricks (minimum 3-4 ans d'expérience)
- Maîtrise expert de PySpark et du traitement distribué de données
- Solides connaissances en architecture data, ETL et pipelines de données
- Expérience dans la conception d'infrastructures big data scalables et sécurisées
- Compétences en optimisation de performances et tuning de clusters
- Maîtrise des concepts de gouvernance et qualité des données
- Français courant obligatoire
- Capacité à travailler en équipe et en environnement agile
Fortement appréciés :
- Expérience avec l'écosystème Apache Spark et les outils big data complémentaires
- Connaissances en cloud computing (AWS, Azure ou GCP)
- Expérience avec les technologies de streaming de données
- Compétences en programmation Python avancée
- Connaissance des pratiques DevOps et CI/CD appliquées aux data pipelines
- Expérience antérieure dans des projets de modernisation d'architectures data
- Certifications Databricks ou équivalentes
- Sens de la pédagogie et capacité de mentorat technique
Publiée le 27/08/2026 - Réf : 2683272