Ik bouw robuuste en schaalbare data pipelines met behulp van pyspark, databricks en airflow

Sommige informatie is automatisch vertaald.

India

Ik spreek Engels

Gecertificeerde Data Engineer

Resultaatgerichte Data Engineer met 4,5 jaar ervaring in het ontwerpen, ontwikkelen, testen, ondersteunen en optimaliseren van schaalbare ETL/ELT pipelines met PySpark, Databricks, SQL, Python, Apache...
Over deze dienst

Heb je schaalbare, productieklare data pipelines nodig? Ik bouw high-performance data-architecturen met Databricks, PySpark, SQL, Apache Airflow en Apache Kafka. Van eenvoudige bestandsinvoer tot complexe real-time streaming, ik lever geoptimaliseerde, kostenefficiënte cloudoplossingen.


Wat ik aanbied:

  • End-to-End ETL/ELT: Veilige data pipelines met PySpark en SQL.
  • Databricks optimalisatie: Delta Lake, Delta Live Tables (DLT) en Unity Catalog setup.
  • Orkestratie: Geautomatiseerde Apache Airflow DAGs met foutafhandeling.
  • Real-time streaming: Lage latency event streaming via Apache Kafka.
  • Prestatieoptimalisatie: Verlaag je cloud compute kosten met geoptimaliseerde queries.


Waarom voor mij kiezen?

  • Productieklaar, schone en herbruikbare code.
  • Ervaring met enterprise cloud (AWS / Azure).
  • Gratis architectuur documentatie inbegrepen.



Bestemmingsplatform:

Snowflake

Databricks Lakehouse

Teradata

Tools & platforms:

Fivetran

Kafka Connect

Microsoft SSIS

Overige