Senior Observability - Sre Engineer H/F Salutech
- Lille - 59
- Freelance
- Bac +2
- Bac +3, Bac +4
- Bac +5
- Services aux Entreprises
- Exp. 5 à 8 ans
À noter sur ce job
Vous avez ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !
Détail du poste
Le besoin
Contexte
Au sein de l'organisation Cloud Platform Engineering (CPE), l'équipe Observabilité conçoit et pilote la plateforme centralisée à destination de l'ensemble des équipes d'ingénierie de Decathlon Digital. Dans un environnement distribué multi-cloud (AWS, GCP, Kubernetes à grande échelle), le/la Senior Observability / SRE Engineer joue un rôle clé dans la définition de la vision technique, la standardisation des pratiques (notamment via OpenTelemetry) et la garantie de la résilience, de la performance et de la maîtrise des coûts (FinOps) de nos systèmes.
Missions
- Participer à la vision technique et piloter la trajectoire d'adoption d'OpenTelemetry (oTEL) sur l'ensemble de l'écosystème applicatif et infrastructure.
- Concevoir et faire évoluer des architectures hautement scalables de collecte, de traitement et de centralisation des signaux (métriques, logs, traces) sur GCP, AWS et Kubernetes.
- Rationaliser l'usage et l'intégration des outils clés de la plateforme (Datadog, OpenTelemetry, Splunk).
- Accompagner la montée en compétences des collaborateurs (mentoring, revues de code, bonnes pratiques d'ingénierie).
- Collaborer directement avec les Feature Teams, Product Managers et Tech Leads pour définir et promouvoir la gestion par les indicateurs de fiabilité (SLI, SLO, SLA, Error Budgets).
- Développer et automatiser les composants d'infrastructure via l'Infrastructure as Code (Terraform, FluxCD, GitOps) et l'intégration continue (GitHub Actions).
- Définir et piloter la stratégie FinOps appliquée à l'observabilité : optimisation des volumes d'ingestion de données, gestion de la valeur versus coût des plateformes SaaS.
- Mettre en place des mécanismes automatisés de détection d'anomalies, de corrélation d'événements et de routage d'alertes afin de réduire le temps moyen de résolution (MTTR).
- Contribuer à la réponse aux incidents majeurs, animer les analyses post-mortem de haut niveau et formaliser les plans d'action d'amélioration continue.
Outils & Environnement
- OpenTelemetry (oTEL)
- Datadog
- Splunk
- AWS, GCP
- Kubernetes (GKE)
- Terraform, FluxCD, GitOps
- GitHub Actions
- Langages de scripting/développement : Python, Go, Bash
Conditions de travail
- Localisation : bureaux de Lille (Btwin Village) ou Paris.
Le profil recherché
Profil recherché
- 5 à 8 ans d'expérience sur un poste SRE, DevOps ou Infrastructure avec une spécialisation en observabilité sur des environnements de production complexes
- Maîtrise approfondie des spécifications et composants OpenTelemetry (oTEL), ainsi que des solutions Datadog, Splunk et architectures de logging/tracing distribué sur Kubernetes
- Solide pratique des Cloud Providers (AWS, GCP) et de l'écosystème Kubernetes (GKE)
- Expertise en Infrastructure as Code (Terraform, GitOps) et maîtrise d'au moins un langage de développement/scripting (Python, Go, Bash)
- Capacité démontrée à analyser et optimiser les coûts d'infrastructure et d'outils d'observabilité à l'échelle d'un groupe (FinOps)
- Leadership d'influence et communication : capacité à vulgariser des enjeux complexes et à porter une vision technique auprès d'interlocuteurs variés
- Esprit d'analyse et résolution de problèmes dans des contextes à forte exigence de disponibilité
Infos complémentaires
Publiée le 05/10/2026 - Réf : 442d4ce729dddad2c98284f5e5b9da6d