Ik bouw ETL, ELT data pipelines met python, spark, airflow en dbt

Sommige informatie is automatisch vertaald.

Pakistan

Ik spreek Engels

Data- en AI-engineer, Python, PySpark, Airflow en Cloud ETL

Wil je betrouwbare data maar vastzitten in gebroken pipelines? Ik help bedrijven robuuste ETL/ELT workflows te bouwen die echt werken. Ik ben een Data Engineer die zich specialiseert in schone, produc...
Over deze dienst

Over deze dienst:

Wil je dat je data wordt opgeschoond, getransformeerd en betrouwbaar stroomt van bron naar bestemming? Ik bouw ETL/ELT-pipelines met moderne data engineering tools zoals Python, PySpark, SQL, Apache Airflow, dbt en Databricks, volgens de Medallion Architecture (Bronze/Silver/Gold) voor schone, productieklare datalaagjes.

Recent werk omvat een pipeline die live data via API binnenhaalt, deze via Airflow orkestreert met automatische foutmeldingen, transformeert met meer dan 10 dbt-modellen met 60+ datakwaliteitstests, en deze weergeeft in een Power BI-dashboard plus een aparte Databricks-pipeline die e-commerce data end-to-end verwerkt met PySpark.

Wat ik aanbied:

  • Ontwerp en ontwikkeling van ETL/ELT-pipelines (batch)
  • Data opschonen, valideren en kwaliteitscontroles uitvoeren
  • Implementatie van Medallion Architecture (Bronze/Silver/Gold)
  • Orkestratie met Apache Airflow
  • Data transformatie met dbt, SQL, PySpark
  • Databricks pipeline ontwikkeling
  • API-gebaseerde data-inname
  • Dashboard integratie (Power BI)

Waarom met mij werken:

  • Werk dat echt verifieerbaar is, elk oplevering wordt ondersteund door een openbare GitHub repo
  • Duidelijke communicatie, realistische deadlines
  • Schoon, gedocumenteerd, productieklare code, geen wegwerpscripts

Bestemmingsplatform:

PostgreSQL

•

Amazon S3

•

Overige

Tools & platforms:

Azure Data Factory

•

Overige

Mijn portfolio