Senior Sre Engineer Observabilité Opentelemetry Kubernetes H/F Naxo
- Paris - 75
- Freelance
- Bac +2
- Bac +3, Bac +4
- Bac +5
- Services aux Entreprises
- Exp. 5 à 8 ans
À noter sur ce job
Vous avez ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !
Détail du poste
Le besoin
Contexte
Au sein de l'organisation Cloud Platform Engineering (CPE), l'équipe Observabilité conçoit et pilote une plateforme centralisée destinée aux équipes d'ingénierie. Dans un environnement distribué multi-cloud (AWS, GCP, Kubernetes à grande échelle), le/la Senior Observability / SRE Engineer participe à la définition de la vision technique, à la standardisation des pratiques (notamment via OpenTelemetry (oTEL)) et à la garantie de la résilience, de la performance et de la maîtrise des coûts (FinOps). Mission longue.
Localisation : Lille (hybride) ou Paris.
Missions
- Participer à la vision technique et piloter la trajectoire d'adoption d'OpenTelemetry (oTEL) sur l'ensemble de l'écosystème applicatif et infrastructure.
- Concevoir et faire évoluer des architectures hautement scalables de collecte, de traitement et de centralisation des signaux (métriques, logs, traces) sur GCP, AWS et Kubernetes.
- Rationaliser l'usage et l'intégration des outils clés de la plateforme (Datadog, OpenTelemetry, Splunk).
- Accompagner la montée en compétences des collaborateurs (mentoring, revues de code, bonnes pratiques d'ingénierie).
- Collaborer avec les Feature Teams, Product Managers et Tech Leads pour définir et promouvoir la gestion par les indicateurs de fiabilité (SLI, SLO, SLA, Error Budgets).
- Développer et automatiser les composants d'infrastructure via l'Infrastructure as Code (Terraform, FluxCD, GitOps) et l'intégration continue (GitHub Actions).
- Définir et piloter la stratégie FinOps appliquée à l'observabilité : optimisation des volumes d'ingestion, gestion de la valeur versus coût.
- Mettre en place des mécanismes automatisés de détection d'anomalies, corrélation d'événements et routage d'alertes ; contribuer à la réponse aux incidents majeurs et aux analyses post-mortem.
Outils & Environnement
- OpenTelemetry (oTEL)
- Datadog, Splunk
- Cloud Providers : AWS, GCP
- Orchestration : Kubernetes (GKE)
- Infrastructure as Code : Terraform, FluxCD, GitOps
- Intégration continue : GitHub Actions
- Langages de développement/scripting : Python, Go, Bash
Conditions de travail
- Mission longue
- Localisation : Lille (hybride) ou Paris
Abonnez-vous à la page NaxoTech sur LinkedIn pour découvrir nos offres régulières :
👉
Le profil recherché
Profil recherché
- 5 à 8 ans d'expérience sur un poste SRE, DevOps ou Infrastructure avec une spécialisation en observabilité sur des environnements de production complexes
- Maîtrise approfondie des spécifications et composants OpenTelemetry (oTEL), solutions Datadog, Splunk et architectures de logging/tracing distribué sur Kubernetes
- Solide pratique des Cloud Providers (AWS, GCP) et de l'écosystème Kubernetes (GKE)
- Expertise en Infrastructure as Code (Terraform, GitOps) et maîtrise d'au moins un langage de développement/scripting (Python, Go, Bash)
- Capacité démontrée à analyser et optimiser les coûts (FinOps)
- Leadership d'influence, communication, esprit d'analyse, résolution de problèmes en contexte haute disponibilité
- Compétences demandées : GOLANG, Kubernetes, GCP, DATADOG, otel, Python Development Services
Infos complémentaires
Publiée le 08/10/2026 - Réf : db8db166a81fb040b8c4f2cee372e1c1