description
L’ingénieur de données concevra et industrialisera des architectures de données évolutives pour des projets d’analytique et d’IA à l’aide de Databricks et de plateformes cloud. Ses responsabilités comprendront la création de pipelines ETL/ELT en mode batch et en continu, l’optimisation des clusters et des requêtes, l’orchestration des déploiements, le contrôle de la qualité des données, la surveillance des flux en production et la gestion de la traçabilité des données. Le poste exige une maîtrise avancée de SQL et de Python, du traitement distribué des données, du cycle de vie logiciel, de la conteneurisation et de l’infrastructure en tant que code, ainsi qu’au moins quatre ans d’expérience en ingénierie des données, dont deux ans dans un écosystème Databricks.
