description
Cloudflare recrute un ingénieur en apprentissage automatique pour développer, optimiser, évaluer par rapport à des références, évaluer et mettre en production des modèles d’apprentissage automatique sur sa plateforme mondiale d’inférence sans serveur. Le poste porte principalement sur le service à faible latence, fiable et efficace de LLM open source de pointe, de modèles vocaux en temps réel et d’autres modèles déployés par les clients sur des GPU et des accélérateurs hétérogènes. Les responsabilités comprennent l’optimisation de l’inférence, l’intégration à l’infrastructure distribuée, les flux de déploiement, l’observabilité, les tests de régression et le mentorat des ingénieurs. Le poste est proposé à Austin, au Texas, ou à Londres, au Royaume-Uni, selon un mode de travail hybride.
