description
Ce poste d’ingénieur senior en apprentissage automatique est axé sur la création et l’optimisation de systèmes d’inférence en production pour des modèles de langage, de vision et de parole. Les responsabilités comprennent la collaboration avec des équipes de recherche et des partenaires externes, la conception de systèmes de service à haut débit et à faible latence, le développement d’outils de profilage et de simulateurs, la prise de décisions relatives à l’architecture technique et le mentorat d’ingénieurs. Le poste exige la direction de projets d’apprentissage automatique de bout en bout, une maîtrise de PyTorch ou JAX, une expérience des frameworks d’inférence et une expérience du déploiement dans le cloud avec Kubernetes et Docker.
