Site Reliability Engineer - Network Observability - N H/F OVHCloud
- Paris - 75
- CDI
- Bac +2
- Bac +3, Bac +4
- Bac +5
- Secteur informatique • ESN
À noter sur ce job
Vous avez ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !
Détail du poste
Au sein de votre équipe #OneTeam
- Rejoindre le département Network & Infrastructure, qui façonne et sécurise l'infrastructure globale d'OVHcloud.
- Intégrer l'équipe en charge des outils d'observabilité réseau, un périmètre critique couvrant plus de 500 000 serveurs, 5 millions d'IP publiques et 40 000 équipements réseau.
Vos principales responsabilités
- Maintenir, moderniser et faire évoluer les outils internes de supervision et de monitoring réseau.
- Participer aux rotations d'astreinte et garantir la haute disponibilité, la fiabilité et la sécurité des outils d'observabilité.
- Contribuer à la culture DevOps/SRE de l'équipe à travers les bonnes pratiques et l'amélioration continue des processus d'exploitation.
- Collaborer avec les membres de l'équipe et les experts réseau afin de concevoir des solutions adaptées aux besoins du terrain.
- Piloter ou contribuer à des projets d'amélioration continue (LEAN) pour renforcer la qualité de service et la résilience des infrastructures.
- Participer aux rituels Agiles de l'équipe et favoriser le partage de connaissances.
L'environnement technique s'appuie notamment sur : Kubernetes, Docker, Prometheus, Grafana, Elasticsearch, Ansible, Terraform, Python, Golang, CI/CD.
Votre futur impact
Dans 6 mois
- Vous aurez pris en main l'écosystème d'observabilité réseau et participerez activement à la maintenance et à la modernisation des outils de supervision.
- Vous serez parfaitement intégré au collectif, à la culture SRE et prendrez part aux rotations d'astreinte en toute sérénité.
Et dans 1 an
- Vous serez autonome sur la gestion et l'évolution des outils d'observabilité critiques.
- Vous jouerez un rôle moteur dans les projets LEAN et dans la mise en place de solutions d'automatisation avancées, impactant directement la résilience de l'infrastructure globale d'OVHcloud.
C
Le profil recherché
- Vous justifiez d'une expérience confirmée en administration ou ingénierie système.
- Vous maîtrisez Kubernetes, Docker et la philosophie Cloud Native.
- Vous disposez d'une solide expérience sur les chaînes de CI/CD et maîtrisez au moins un outil de déploiement (Ansible, Terraform, Puppet,...).
- Vous maîtrisez un ou plusieurs langages de scripting (Python, Golang...).
- Vous possédez de solides connaissances sur les outils de supervision et d'observabilité (Prometheus, Grafana, Elasticsearch).
- Vous faites preuve d'un excellent esprit d'équipe, d'un bon sens de la collaboration et vous vous intégrez rapidement au sein d'un collectif.
C'est un +
- Une première expérience ou une appétence particulière pour les problématiques d'infrastructure réseau à très grande échelle est un véritable atout.
Site Reliability Engineer - Network Observability - F/H/N
Les avantages
- Une politique de télétravail flexible
- Un plan d'actionnariat salarié
- Un programme de reconnaissance de l'ancienneté
- Des subventions vacances et sport
- Des équipes multi-culturelles
- Une plateforme de développement de compétences ouverte à tous
- Un engagement fort dans le développement durable
- Des plateformes d'accompagnement en ligne pour vous et votre famille
Les étapes de recrutement
Les étapes de recrutement peuvent varier selon l'offre à laquelle vous postulez.
-
Entretien téléphonique avec l'équipe recrutement
-
Entretien physique ou en visio avec un recruteur
-
Test technique si le poste l'exige
-
Entretien manager et rencontre avec l'équipe
-
Debriefing avec le recruteur et proposition d'embauche le cas échéant
-
OVHCloud en images
Publiée le 17/09/2026 - Réf : aa43578be0feb52d40a1e76be560a79d