Ik bouw ETL-pijplijnen met Databricks en PySpark
Over deze dienst
Worstelen met rommelige data, kapotte pijplijnen of dashboards die niet het echte verhaal vertellen? Ik kan helpen.
Ik ben een Data Engineer met meer dan 4 jaar praktische ervaring in het ontwerpen, bouwen en optimaliseren van end-to-end data pipelines en cloud data platforms.
WAT IK VOOR JOU KAN DOEN:
- Bouw en orkestreer ETL/ELT-pijplijnen met Apache Airflow
- Ontwerp en beheer cloud data warehouses op Snowflake en Databricks
- Schrijf efficiënte, productieklare SQL en Python (PySpark) voor grootschalige datatransformatie
- Migreer legacy workflows (bijvoorbeeld Hive/Oozie) naar moderne Databricks/Airflow pijplijnen
- Maak ruwe data schoon, transformeer en modelleer deze tot analytisch gereed tabellen
- Optimaliseer bestaande pijplijnen voor prestaties (partitionering, caching, incrementele loads)
- Bouw dashboards in Power BI, Tableau of Qlik op basis van je pijplijn
WAAROM MET MIJ WERKEN:
- Praktijkervaring met het volledige data stack van ingestie tot dashboard
- Heldere communicatie gedurende het hele project, niet alleen een code drop
- Ik leg uit wat ik heb gebouwd en waarom, zodat je nooit vastzit aan een black box die je niet begrijpt

