Site Reliability Engineering Sre - Sysops 3- d'Expérience H/F
ClubSec
- Ivry-sur-Seine - 94
- Freelance
- Bac +2
- Bac +3, Bac +4
- Services aux Entreprises
Les compétences pour ce job
Vous vous reconnaissez dans ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !
Détail du poste
Le besoin
Contexte de la mission
DOCAPOSTE est l'entité digitale du groupe La Poste. Docaposte, société de la branche numérique du Groupe La Poste, est une entreprise créée en 2007 qui propose une gamme d'offres pour gérer les échanges professionnels de documents. Docaposte est une société de services en ingénierie informatique et traitement de documents : numérisation de documents pour archivage électronique ou diffusion électronique, édition et mise sous pli (éditique industrielle), archivage électronique, vidéo-codage.
Rôle
Rattaché(e) à la direction des Systèmes d'Informations Groupe Docaposte, dans le pôle des Services, vous êtes le garant de la fiabilité, de la performance et de la pérennité des applications en production, en adoptant une approche systématique et automatisée afin de garantir des engagements de service de la DSI envers ces clients internes (Business Units - BUs). Vous travaillez en étroite collaboration avec les équipes d'ingénierie BU d'une part et des équipes d'infrastructure, de Centre de Services et le Service Delivery Manager. Vous contribuez à l'adoption du modèle SRE et à la transformation du modèle d'exploitation vers ce modèle (pour accompagner la transformation de Docaposte vers le cloud).
Objectifs et livrables
Vos Missions
Gestion des Systèmes et des Applications et des flux
Garantir les engagements de services
Assurer une surveillance et une observabilité des systèmes, des applications et des flux, identifier et résoudre les problèmes avant qu'ils n'affectent les utilisateurs (capacity planning, mise en oeuvre des mécanismes de résiliences et haute disponibilité, ...)
Planifier, surveiller les différents traitements
Mettre en production les nouvelles applications ou évolutions en mode CI/CD et GitOps)
Gestion des différents environnements (Recette, Pré Production, Production)
Gestion des Incidents et des Erreurs
Répondre rapidement aux incidents, analyser les causes et mettre en oeuvre des solutions pour prévenir la récurrence des problèmes
Effectuer les contrôles au quotidien des traitements, corriger les erreurs, faire les reprises nécessaires et en informer les responsables
Automatisation et Optimisation des Performances
Développer et maintenir des scripts et des outils d'automatisation pour améliorer les opérations et réduire les interventions manuelles
Travailler continuellement à l'amélioration des performances des systèmes et des applications, en évaluant et en optimisant les configurations
Automatiser des déploiement (y compris infrastructure as A Code, Pipelines CI/CD, Chart de déploiement Kubernetes, ou scripts de déploiement)
Gérer de configuration des assets
Collaboration et Communication
Travailler en étroite collaboration avec les équipes de développement pour intégrer les pratiques de production dès la conception et tout au long du cycle de vie des applications
Participer à la formation et à l'accompagnement des autres membres de l'équipe, partager les connaissances et les meilleures pratiques en matière de fiabilité et d'opérations
Gestion de l'Infrastructure et de la Sécurité
Superviser et gérer l'infrastructure Cloud provisionnée, assurer une utilisation efficace des ressources et une conformité aux standards de l'entreprise
Participer à la définition de la politique de sauvegarde afin de s'assurer des engagements des services
Utiliser et respecter les processus DSI basés sur des bonnes pratiques ITIL tout en adoptant une posture DevOps
Documentation et Suivi
Mettre en place et documenter des procédures et des outils de suivi
Maintenir une documentation à jour des processus, des configurations et des interventions, et générer des rapports réguliers sur la santé et la performance des systèmes
Compétences Techniques requises
Administration
Connaissance approfondie des systèmes d'exploitation (Linux/Windows)
Connaissance de la configuration réseau
Connaissance des plateformes J2EE (JBoss, Tomcat)
Connaissance de l'architecture des systèmes en environnement Cloud virtualisé
Connaissance approfondie de l'orchestration de conteneurs avec Kubernetes (pods, services, ingress, volumes)
Administration de clusters Kubernetes via Rancher (gestion multi-clusters, projets, utilisateurs et rôles)
Programmation et Scripting
Capacité à écrire des scripts pour l'automatisation des tâches et la résolution de problèmes : Ansible, terraforme, Helm, Ansible, Shell
Gestion de configuration et CI/CD (Gitlab CI/Nexus)
Déploiement et packaging d'applications sur Kubernetes à l'aide de Helm (charts, templates, valeurs)
Automatisation de la gestion des clusters Kubernetes avec Rancher CLI et API
Connaissance du Cloud
Expérience avec des plateformes cloud (VMware NSX/Openstack/Outscale)
Gestion des ressources et compréhension des services cloud
Connaissance des solutions de stockage pour conteneurs (PV/PVC, CSI, stockage distribué)
Outils de Surveillance et d'Observabilité
Expérience avec les outils de surveillance et d'observabilité (Prometheus, Grafana, Zabbix): mise en oeuvre de tableaux de bord, de configuration des seuils d'alertes
Expérience avec les systèmes de logging (loki, ELK) : formatage des logs, configuration d'envoi, requêtage et mise en place d'indicateurs
Mise en place de la surveillance des clusters Kubernetes et Rancher (métriques, alertes, health checks)
Collecte et agrégation des logs des pods Kubernetes via Loki ou ELK (configuration des exporters, sidecars)
Orchestration & Conteneurisation
Maîtrise de Kubernetes : déploiement d'applications, gestion des namespaces, autoscaling, rolling updates
Administration de clusters avec Rancher : RKE2, gestion multi-clusters, catalogues d'applications, gestion des projets et des équipes
Compétences Non-Techniques requises
Résolution de Problèmes et Analyse
Aptitude à analyser et résolution de problèmes complexes en identifiant rapidement la cause racine des incidents et réactivité pour trouver la solution la plus adaptée.
Gestion du Stress et Adaptabilité
Capacité à rester calme et efficace dans des situations à haute pression pour gérer les urgences avec une approche systématique et adaptée aux circonstances de crises.
Travail d'Équipe et Communication
Collaborer avec diverses équipes techniques, partager des connaissances et communiquer efficacement tant avec les équipes techniques qu'avec les parties prenantes non techniques, avec une capacité à s'adapter à son auditoire et à vulgariser les aspects techniques.
Esprit d'équipe, motivation, sens du service, et capacité à relayer rapidement les informations, avec une reconnaissance pour les qualités rédactionnelles et orales.
Orientation vers l'Amélioration Continue et Innovation
Volonté de rechercher continuellement des moyens d'améliorer les processus et les systèmes, avec une curiosité et une force de proposition pour optimiser l'existant et rester à jour avec les évolutions technologiques.
Gestion de Projet et Organisation
Capacité à gérer des projets, y compris la planification, l'exécution, et le suivi du progrès, avec une autonomie et une rigueur pour modéliser et formaliser les processus.
Pratiques ITIL et sensibilisation aux normes de management/sécurité SI (ISO 9001, 27001)
Le profil recherché
Profil recherché
Profil recherché
Vous êtes un(e) professionnel(le) expérimenté(e) en informatique, avec une formation supérieure en informatique (Bac +2 minimum) et une expérience significative, entre 3 et 6 ans, sur des fonctions similaires. Vous avez une connaissance globale back office/front office et des environnements dans lesquels vous avez évolué vous ont permis d'acquérir de solides bases dans la compréhension de l'exploitation.
Compétences demandées
Compétences
plateformes J2EE (JBoss, Tomcat) Confirmé
Administration de clusters avec Rancher Confirmé
CI/CD Confirmé
KUBERNETES Expert
plateformes cloud (VMware NSX/Openstack/Outscale) Avancé
LINUX / WINDOWS Expert
Infos complémentaires
Publiée le 24/08/2026 - Réf : 627e8dd57b41802b49e03f788ab5da53