Lead Data Engineer delivering Azure-based data platforms and AI-powered workflow automation across ETL, validation, and production support. Led a team of 4 to build automated pipelines that cut data processing time by 40%, while improving warehouse query efficiency by 25% through PySpark, Azure Databricks, and Synapse tuning. Integrates LLMs, Python, and REST APIs into production solutions for document analysis, data validation, and intelligent query handling.
Python
Azure Data Factory
Azure Databricks
PySpark
SQL
Data pipeline design
Data transformation workflows
Data quality validation