Ik zal etl-, datapijplijn- en data-engineeringprojecten uitvoeren
Senior Data Engineer die zich specialiseert in Cloud ETL en Architectuur
Over deze dienst
Heb je een betrouwbare ETL-pipeline nodig om je data workflow te automatiseren?
Ik bouw een schone, schaalbare ETL/ELT-pipeline met Python, SQL, Apache Spark/PySpark en Airflow.
Ik kan je helpen met:
- Data ophalen uit APIs, CSV/Excel-bestanden en databases
- Data schoonmaken, transformeren, valideren en dedupliceren
- ETL/ELT-pipelines met Python en SQL
- PySpark/Spark verwerking voor grote datasets
- Airflow DAGs en workflow orchestratie
- Data laden in PostgreSQL, SQL Server, Snowflake, Databricks of andere data platforms
- Incremental loads, planning en pipeline optimalisatie
- Fouten opsporen en bestaande pipelines verbeteren
Je krijgt schone, onderhoudbare code, goede documentatie en een oplossing die op jouw wensen is afgestemd.
Heb je een bestaande pipeline die niet werkt? Ik kan het probleem opsporen en optimaliseren.
Tools & platforms:
Azure Data Factory
Mijn portfolio
Andere Data engineering diensten die ik aanbied
Veelgestelde vragen
Automatische vertaling
Met welke soorten databronnen kan ik werken?
Ik kan werken met SQL-databases, CSV/Excel-bestanden, REST APIs, cloud storage, JSON-data en vele andere gestructureerde databronnen.
Kun je Apache Airflow-workflows bouwen?
Ja. Ik maak Airflow DAGs met planning, afhankelijkheden, retries, logging en monitoring.
Ondersteun je Apache Spark?
Ja. Ik bouw Spark-pijplijnen voor grootschalige data processing, transformaties en ETL-workloads.
Kun je terugkerende data jobs automatiseren?
Absoluut. Ik maak geplande pijplijnen die automatisch data extraheren, transformeren, valideren en laden.
Kun je de pijplijn deployen?
Ja. Deployment hulp met Docker of cloud platforms kan als Gig Extra of in het Premium pakket worden inbegrepen.

