Description
Owns the Training Environment data architecture end-to-end, designing and governing data selection and sampling strategies, building and maintaining data catalogs, defining annotation pipeline architectures, architecting the data flywheel, and owning data pipelines and infrastructure. Works closely with various ML/AI teams to ensure alignment with model training requirements and maintains comprehensive documentation.
