Ik bouw python ETL-pijplijnen voor je data warehouse
Product Engineering stagiair
Over deze dienst
Ik ben een student Computer Science engineering met praktische ervaring in het bouwen van ETL-pijplijnen en data engineering oplossingen met Python, SQL en Databricks. Via echte stagewerkzaamheden heb ik backend services en REST API's ontwikkeld die grote hoeveelheden data verwerken (120M+ records), Databricks, Unity Catalog en Delta Tables geïntegreerd in productie workflows, en data validatie en cleanup pipelines geïmplementeerd voor engineering teams.
Wat ik aanbied:
Ontwerp & ontwikkeling van ETL-pijplijnen (extract, transform, load)
Connectiviteit met databronnen (databases, API's, bestanden)
Data cleaning, formatting en validatie
Workflows met Databricks & Delta Table
API-integratie voor geautomatiseerde datastromen
Schoon, gedocumenteerd en herbruikbaar code
Ik focus op het schrijven van pijplijnen die betrouwbaar, goed gestructureerd en gemakkelijk te onderhouden zijn, niet alleen snelle scripts.
Ik communiceer duidelijk gedurende het hele project en lever op tijd.
Technologie:
apache vonk
•
Java
•
Python
•
R
•
SQL
•
Databricks
Mijn portfolio
Veelgestelde vragen
Automatische vertaling
Werk je met data warehouses anders dan Databricks?
Databricks is mijn primaire expertise. Voor andere platforms, stuur me eerst een bericht zodat ik kan bevestigen of het past. Maar ik kan werken, als ik er eenmaal vertrouwd mee ben.
Krijg ik de broncode?
Ja, inbegrepen in het Premium pakket (of als extra).
Kun je meerdere databronnen verwerken?
Ja — Standaard- en Premium-pakketten ondersteunen meerdere bronnen.
Welke informatie heb je nodig om te starten?
Jouw databron(n), doeloutput/data warehouse, en eventuele specifieke transformatielogica.
