Ik bouw schaalbare databricks ETL-pijplijnen met behulp van pyspark sql
Over deze dienst
Heb je een betrouwbare Databricks-pijplijn nodig in plaats van fragiele notebooks en handmatige data-verwerking?
Ik ben een data engineer met 9 jaar professionele ervaring in het bouwen van ETL-pijplijnen, data platforms en analytics oplossingen. Ik werk met Databricks, PySpark, Spark SQL, Delta Lake, Python en cloud data services om ruwe data om te zetten in schone, analytics-klare datasets.
Ik kan je helpen met:
- Databricks notebooks met PySpark en Spark SQL
- Batch ETL en ELT pijplijn ontwikkeling
- Bronzen, zilveren en gouden lakehouse architectuur
- Delta Lake tabellen, MERGE en incrementele loads
- Data schoonmaken, transformeren en valideren
- Workflow en job configuratie
- Debugging en prestatieverbeteringen
- Duidelijke code commentaren en technische documentatie
Je ontvangt onderhoudbare broncode, duidelijk gedefinieerde pijplijnlogica en praktische documentatie voor het bedienen van de oplossing.
Neem contact met mij op via Fiverr voordat je het Premium pakket bestelt of een project met productie toegang, streaming, infrastructuur setup, gevoelige data of een dringende deadline.
Warehouse Platform:
Snowflake
•
BigQuery
•
Databricks
Projecttype:
Nieuwbouw

