About this role
DÉTAILS
CDI
IT, Technologie & Produit
LYON, FR, 69003
VOTRE MISSION
AI Infrastructure Engineer - Inference, Serving, Training & Data de production H/F/N
Au sein de votre équipe OneTeam
- Intégrer l’équipe AI Infrastructure & Data au sein de la BU AI. Votre mission sera de concevoir, déployer, superviser et maintenir en conditions opérationnelles l’infrastructure dédiée à l’entraînement (training) et à l’inférence des modèles d’intelligence artificielle pour nos besoins internes.
- Fournir aux équipes Data Science, ML Engineering et produits internes une plateforme IA performante, disponible, sécurisée et efficiente en coûts et en énergie, en s’appuyant sur nos datacenters et notre savoir-faire industriel. Ces utilisateurs, vos futurs collègues, exploiteront notre infrastructure GPU, de stockage et réseau afin d'utiliser une plateforme hautement automatisée en self-service, du dataset au modèle en production.
Vos principales responsabilités
-
Conception, déploiement et exploitation de notre plateforme d’inférence interne (vLLM, Triton, autoscaling, batching, multi-tenancy, haute disponibilité)
-
Optimisation de la latence, du débit et du coût de l’inférence (quantization, placement des modèles, dimensionnement des ressources GPU)
-
Assurance de l’exploitation des workloads de training et de fine-tuning sur le socle de calcul opéré par l’équipe
-
Portage de la continuité de la chaîne training vers inférence en industrialisant le passage du checkpoint au modèle servi en production
-
Être responsable des données du cycle de vie des modèles (registre, versioning, traçabilité dataset-entraînement-modèle-déploiement)
-
Être responsable des données de production de l’inférence (log