description
Le poste consiste à concevoir et améliorer des pipelines pour des données liées aux lieux et à la localisation, en traitant des signaux réels et bruités ainsi que de vastes ensembles de données géospatiales. Les responsabilités incluent l’amélioration de la qualité des données et de leur observabilité, la définition de métriques et de boucles de rétroaction, le prototypage en Python, SQL, notebooks ou outils similaires, l’intégration d’expérimentations en production avec des systèmes back-end, ainsi que la réalisation d’évaluations hors ligne et de tests A/B. Le poste requiert une solide maîtrise de Python et de SQL, une expérience de production avec Python ou Scala, ainsi qu’une expérience avec PySpark, Spark SQL, Spark Streaming, Parquet, Iceberg, les grands jeux de données, les pipelines, les données géospatiales et la mesure de la qualité des données. Le poste est sur site cinq jours par semaine au centre de Paris et comprend une couverture santé ainsi que d’autres avantages liés aux congés.
