Recrutement Asteins

Ingénieur MLOps - Llmops Senior Plateforme IA & Kubernetes H/F - Asteins

  • Saint-Denis - 93
  • CDI
  • Asteins
Publié le 7 octobre 2026
Postuler sur le site du recruteur

Les missions du poste


Dans le cadre du développement de ses activités, ASTEINS recherche un Ingénieur LLMOps / MLOps Senior H/F spécialisé en Model Serving pour intervenir sur une plateforme d'intelligence artificielle dédiée à l'industrialisation et à l'exploitation d'agents IA.

Votre mission

Vous industrialisez l'exposition des modèles aux agents IA (model serving) dans un contexte de production maîtrisé :

- Mettre en oeuvre les services d'inférence et les interfaces d'accès aux modèles
- Structurer le routage entre modèles, les quotas, les timeouts et les stratégies de fallback
- Administrer les versions de modèles, les endpoints et les paramètres de génération
- Contribuer aux choix d'hébergement : GPU, Kubernetes, services managés ou déploiement interne
- Mesurer latence, débit, taux d'erreur, consommation GPU et coût des appels
- Construire les dashboards et alertes associés aux services modèles
- Optimiser l'inférence : paramètres, mise en cache, stratégies de batch
- Produire les traces nécessaires aux analyses de qualité et aux arbitrages économiques
- Mettre en place la traçabilité des versions de modèles utilisées par les agents
- Contribuer aux gates de validation avant l'exposition d'un modèle à un cas d'usage
- Documenter les standards LLMOps, les procédures de changement et de rollback
- Collaborer avec le data scientist, le SRE et les équipes métier

- Plus de 7 ans d'expérience en ingénierie (MLOps, DevOps, plateforme, infrastructure ou ML Engineering)
- Plus de 5 ans sur Kubernetes et le déploiement applicatif
- Plus de 2 ans sur chacun des domaines suivants :
- MLOps / LLMOps de production, serving de modèles et APIs d'inférence
- GPU : dimensionnement et optimisation
- observabilité des appels de modèles
- Python et écosystème IA
- versioning, registry et gouvernance de modèles
- sécurité, quotas, coûts et contrôle d'usage
- Connaissance des environnements de production et des contraintes de sécurité des plateformes critiques
- Aisance à documenter vos choix techniques et à transférer vos pratiques
- Disponibilité ponctuelle en horaires adaptés lors des bascules de versions ou des tests de charge
- Un plus : expérience des agents IA, du RAG, d'outils de serving ou de supervision (vLLM, Triton, KServe, MLflow, Prometheus, Grafana)

Vos qualités

Rigueur d'exploitation, sens du service, esprit d'analyse et de synthèse, autonomie, goût pour l'automatisation, aisance relationnelle avec des équipes d'architecture, d'exploitation et de sécurité.

ASTEINS est une entreprise de services du numérique à taille humaine spécialisée dans les métiers de l'IT, de l'ingénierie et des télécommunications. Nous accompagnons nos clients sur des projets stratégiques à forte valeur ajoutée en mettant l'expertise technique, l'engagement et la proximité au coeur de notre approche.
Postuler sur le site du recruteur

Parcourir plus d'offres d'emploi