职位描述
Key Responsibilities:
Design and optimize TB-scale ETL/ELT pipelines using Azure Data Factory (ADF), SSIS, and Logic Apps;
Architect storage and analytics models in Azure Synapse Analytics/ADLS with partitioning and indexing;
Implement data validation (U-SQL/Python) for quality assurance and compliance (GDPR/DMA);
Maintain technical documentation (data dictionaries, pipeline specs) and align solutions with business needs.
职位要求
Qualifications:
5+ years in data engineering with expertise in SQL/PySpark and Azure tools (ADF/Synapse/ADLS);
Proficient in data modeling, performance tuning, and governance for large-scale data;
Skilled in Azure monitoring tools (Monitor/Log Analytics) and CI/CD integration for DataOps;
Azure Data Engineer (DP-203) certification or real-time streaming experience preferred.