Data Engineer specializing in scalable pipelines and modern Lakehouse architectures. Expert in large-scale data processing (+500M records) and implementing automation frameworks that significantly increase operational efficiency.
- Large-Scale Data Engineering: Development and maintenance of production ETL/ELT pipelines under Medallion Architecture (Bronze, Silver, Gold), utilizing PySpark, Delta Lake, and Spark on Databricks.
- Architecture & Automation: Designing scalable ingestion frameworks and orchestrating complex workflows via Apache Airflow and Azure Data Factory (ADF), reducing operational times from 24 hours to under 20 minutes.
- Governance & Quality: Implementing Data Quality practices and sensitive data governance (LGPD) using Microsoft Purview, interacting directly with Internal Audit stakeholders.
- Cloud Infrastructure: Managing data processing within Data Lakes (ADLS) and implementing robust CI/CD pipelines for automated deployments in cloud environments.
- B.S. in Computer Science – Universidade Cidade de São Paulo.
- IT Technician – ETEC Aprígio Gonzaga.