Ingénieur MLOps - Llmops Senior Plateforme IA & Kubernetes H/F Asteins

  • Saint-Denis - 93
  • CDI
  • Bac +2
  • Bac +3, Bac +4
  • Bac +5
  • Services aux Entreprises
  • Exp. 7 ans min.
Lire dans l'app

À noter sur ce job

Vous avez ces compétences ? Cliquez dessus pour les ajouter rapidement à votre profil !

Détail du poste

Dans le cadre du développement de ses activités, ASTEINS recherche un Ingénieur LLMOps / MLOps Senior H/F spécialisé en Model Serving pour intervenir sur une plateforme d'intelligence artificielle dédiée à l'industrialisation et à l'exploitation d'agents IA.

Votre mission

Vous industrialisez l'exposition des modèles aux agents IA (model serving) dans un contexte de production maîtrisé :

- Mettre en oeuvre les services d'inférence et les interfaces d'accès aux modèles
- Structurer le routage entre modèles, les quotas, les timeouts et les stratégies de fallback
- Administrer les versions de modèles, les endpoints et les paramètres de génération
- Contribuer aux choix d'hébergement : GPU, Kubernetes, services managés ou déploiement interne
- Mesurer latence, débit, taux d'erreur, consommation GPU et coût des appels
- Construire les dashboards et alertes associés aux services modèles
- Optimiser l'inférence : paramètres, mise en cache, stratégies de batch
- Produire les traces nécessaires aux analyses de qualité et aux arbitrages économiques
- Mettre en place la traçabilité des versions de modèles utilisées par les agents
- Contribuer aux gates de validation avant l'exposition d'un modèle à un cas d'usage
- Documenter les standards LLMOps, les procédures de changement et de rollback
- Collaborer avec le data scientist, le SRE et les équipes métier

- Plus de 7 ans d'expérience en ingénierie (MLOps, DevOps, plateforme, infrastructure ou ML Engineering)
- Plus de 5 ans sur Kubernetes et le déploiement applicatif
- Plus de 2 ans sur chacun des domaines suivants :
- MLOps / LLMOps de production, serving de modèles et APIs d'inférence
- GPU : dimensionnement et optimisation
- observabilité des appels de modèles
- Python et écosystème IA
- versioning, registry et gouvernance de modèles
- sécurité, quotas, coûts et contrôle d'usage
- Connaissance des environnements de production et des contraintes de sécurité des plateformes critiques
- Aisance à documenter vos choix techniques et à transférer vos pratiques
- Disponibilité ponctuelle en horaires adaptés lors des bascules de versions ou des tests de charge
- Un plus : expérience des agents IA, du RAG, d'outils de serving ou de supervision (vLLM, Triton, KServe, MLflow, Prometheus, Grafana)

Vos qualités

Rigueur d'exploitation, sens du service, esprit d'analyse et de synthèse, autonomie, goût pour l'automatisation, aisance relationnelle avec des équipes d'architecture, d'exploitation et de sécurité.

ASTEINS est une entreprise de services du numérique à taille humaine spécialisée dans les métiers de l'IT, de l'ingénierie et des télécommunications. Nous accompagnons nos clients sur des projets stratégiques à forte valeur ajoutée en mettant l'expertise technique, l'engagement et la proximité au coeur de notre approche.

Infos complémentaires

49 - 63 K€ brut annuel

Publiée le 07/10/2026 - Réf : 179548611W

Postuler
Créez votre compte
Hellowork et postulez

sur le site du partenaire !

Ces offres pourraient aussi
vous intéresser

AXA en France recrutement
AXA en France recrutement
Voir l’offre
il y a 15 jours
Xelians recrutement
Nanterre - 92
CDI
50 000 - 55 000 € / an
Télétravail partiel
Voir l’offre
il y a 8 jours
Voir plus d'offres
Les sites
L'emploi
  • Offres d'emploi par métier
  • Offres d'emploi par ville
  • Offres d'emploi par entreprise
  • Offres d'emploi par mots clés
L'entreprise
  • Qui sommes-nous ?
  • On recrute
  • Accès client
Les apps
Nous suivre sur :
Informations légales CGU Politique de confidentialité Gérer les traceurs Accessibilité : non conforme Aide et contact