Description
Le poste consiste à déployer des modèles de langage, mettre en place des architectures RAG, administrer et maintenir l’infrastructure d’exécution et de déploiement via Kubernetes et l’Infrastructure-as-Code, ainsi qu’à garantir la fiabilité et la performance des modèles en production avec des outils de monitoring. Il demande au moins quatre ans d’expérience en MLOps et/ou LLMOps, ainsi qu’une maîtrise des environnements cloud public ou des plateformes de données modernes.
