وصف
سيقوم مهندس البيانات ببناء وتشغيل خطوط أنابيب بيانات مجمّعة وبثّية تدعم التجريب (experimentation)، وكشف الاحتيال (fraud detection)، والتوصيات (recommendations)، والتخصيص (personalization). يركز الدور على Kafka وSpark على Databricks وAirflow ونمذجة البيانات وجودة خطوط الأنابيب والموثوقية (reliability) وعمليات الاستدعاء عند الطلب (on-call). كما سيعمل بالتعاون مع علماء بيانات ومهندسي الباكند. يتطلب خبرة لا تقل عن ثلاث سنوات في هندسة البيانات أو هندسة البرمجيات، وإتقانًا قويًا لـ Python وPySpark وKafka ومعالجة البثّ، وDatabricks وSQL ومهارات قواعد البيانات العلائقية (relational databases)، مع تفضيل الخبرة بـ Flink وML feature stores وMLOps وDocker وKubernetes وتجربة SaaS.
