Ik bouw een AWS data lake en ETL-pipeline met PySpark

Sommige informatie is automatisch vertaald.

Pakistan

Ik spreek Engels

Cloud Data Engineer die schaalbare ETL-pipelines bouwt

Hoi, ik ben een onafhankelijke Data Engineer die gespecialiseerd is in het bouwen van schaalbare ETL-pipelines en robuuste cloud data architecturen. Ik help bedrijven om rommelige, ongestructureerde l...
Over deze dienst

Als Data Engineer ontwerp ik robuuste cloud-native architecturen en schaalbare ETL-pipelines. Of het nu gaat om het verwerken van grote volumes logs of het bouwen van Medallion Data Lakes, ik lever schone, geoptimaliseerde oplossingen.

Wat ik aanbied:

  • End-to-End ETL Pipelines: Geautomatiseerde data extractie, transformatie en loading met Python en PySpark.
  • Cloud Data Lakes: Architectuur van serverless Medallion Data Lakes (Bronze, Silver, Gold) op AWS (S3, Glue, Athena).
  • Database Architectuur: Relationale databases ontwerpen (3NF) en complexe SQL-query's optimaliseren (CTEs, Window Functions) in PostgreSQL.
  • Prestaties Verbeteren: Verwerkingstijden verminderen en opslagkosten verlagen met formaten zoals Apache Parquet.

Tech Stack: AWS (S3, Glue, Athena) | PySpark | Python | PostgreSQL | Geavanceerd SQL | Git/GitHub

Waarom voor mij kiezen? Ik schrijf productieklare code, zorg voor schaalbare ontwerpen en volg strikt de beste praktijken in data engineering.

Stuur me gerust een bericht voordat je bestelt om je exacte project te bespreken!

Taal:

Engels

Urdu

Technische expertise:

dbt (Data Build Tool)

Apache Airflow

Expertise:

Datapijplijnen

ETL-ontwikkeling

Data-integratie

Branche:

Gegevensanalyse

Mijn portfolio