Ingénieur MLOps - Llmops Senior Plateforme IA & Kubernetes H/F Asteins
- Saint-Denis - 93
- CDI
- Bac +2
- Bac +3, Bac +4
- Bac +5
- Services aux Entreprises
- Exp. 7 ans min.
À noter sur ce job
Vous avez ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !
Détail du poste
Dans le cadre du développement de ses activités, ASTEINS recherche un Ingénieur LLMOps / MLOps Senior H/F spécialisé en Model Serving pour intervenir sur une plateforme d'intelligence artificielle dédiée à l'industrialisation et à l'exploitation d'agents IA.
Votre mission
Vous industrialisez l'exposition des modèles aux agents IA (model serving) dans un contexte de production maîtrisé :
- Mettre en oeuvre les services d'inférence et les interfaces d'accès aux modèles
- Structurer le routage entre modèles, les quotas, les timeouts et les stratégies de fallback
- Administrer les versions de modèles, les endpoints et les paramètres de génération
- Contribuer aux choix d'hébergement : GPU, Kubernetes, services managés ou déploiement interne
- Mesurer latence, débit, taux d'erreur, consommation GPU et coût des appels
- Construire les dashboards et alertes associés aux services modèles
- Optimiser l'inférence : paramètres, mise en cache, stratégies de batch
- Produire les traces nécessaires aux analyses de qualité et aux arbitrages économiques
- Mettre en place la traçabilité des versions de modèles utilisées par les agents
- Contribuer aux gates de validation avant l'exposition d'un modèle à un cas d'usage
- Documenter les standards LLMOps, les procédures de changement et de rollback
- Collaborer avec le data scientist, le SRE et les équipes métier
- Plus de 7 ans d'expérience en ingénierie (MLOps, DevOps, plateforme, infrastructure ou ML Engineering)
- Plus de 5 ans sur Kubernetes et le déploiement applicatif
- Plus de 2 ans sur chacun des domaines suivants :
- MLOps / LLMOps de production, serving de modèles et APIs d'inférence
- GPU : dimensionnement et optimisation
- observabilité des appels de modèles
- Python et écosystème IA
- versioning, registry et gouvernance de modèles
- sécurité, quotas, coûts et contrôle d'usage
- Connaissance des environnements de production et des contraintes de sécurité des plateformes critiques
- Aisance à documenter vos choix techniques et à transférer vos pratiques
- Disponibilité ponctuelle en horaires adaptés lors des bascules de versions ou des tests de charge
- Un plus : expérience des agents IA, du RAG, d'outils de serving ou de supervision (vLLM, Triton, KServe, MLflow, Prometheus, Grafana)
Vos qualités
Rigueur d'exploitation, sens du service, esprit d'analyse et de synthèse, autonomie, goût pour l'automatisation, aisance relationnelle avec des équipes d'architecture, d'exploitation et de sécurité.
ASTEINS est une entreprise de services du numérique à taille humaine spécialisée dans les métiers de l'IT, de l'ingénierie et des télécommunications. Nous accompagnons nos clients sur des projets stratégiques à forte valeur ajoutée en mettant l'expertise technique, l'engagement et la proximité au coeur de notre approche.
Infos complémentaires
Publiée le 07/10/2026 - Réf : 179548611W