Descripción
El puesto crea canalizaciones de procesamiento de datos con alto rendimiento, gestiona bases de datos relacionales y construye entornos de data lake portables para la nube. Las responsabilidades incluyen diseñar canalizaciones de ETL basadas en Python usando la arquitectura Medallion, estandarizar el almacenamiento con Parquet, Apache Iceberg y Delta Lake, integrar DuckDB con Python, arquitectar bases de datos PostgreSQL y SQLite y escalar las cargas de trabajo con Databricks o Apache Spark. Los requisitos solicitan experiencia avanzada en SQL, PostgreSQL y SQLite, experiencia en canalizaciones de Python y DuckDB, dominio de formatos de almacenamiento abiertos, experiencia con la arquitectura Medallion y familiaridad con Databricks o PySpark.
