Ik bouw productie pyspark, python en sql data pipelines

Sommige informatie is automatisch vertaald.

India

Ik spreek Engels, Hindi

Data- en backend engineer

Meer dan 13 jaar ervaring in het bouwen van data platforms en backend systemen — Goldman Sachs, Walmart Global Tech, Ola en twee gefinancierde startups waar ik teams van 6-12 engineers leid. Wat ik e...
Over deze dienst

Ik heb meer dan 13 jaar ervaring in het bouwen van data pipelines bij Goldman Sachs, Walmart Global Tech, Ola en twee venture-backed startups. Pipelines die ik beheerde verplaatsen dagelijks terabytes aan data. Nu bouw ik die van jou.


WAT JE KRIJGT

- Een werkende PySpark / Python / SQL pipeline, geen notebook dump

- Idempotent en herhaalbaar, dus veilig om te herhalen na een fout

- Omgaat met nulls, duplicates, late data en schema drift in plaats van crashen

- Leesbare, commentaar gevulde code, plus een korte video waarin ik het uitleg


IK WERK MET

PySpark, Pandas, Polars, SQL (Postgres, MySQL, Redshift, BigQuery), Airflow, dbt, Kafka, Iceberg, AWS (S3, EMR, Glue, Lambda)


TYPISCHE OPDRACHTEN

- Rommelige CSV/JSON/Parquet omzetten in een schone, gemodelleerde tabel

- Een Spark job of query die echt af moet maken

- Een geplande extractie van een API of database

- Window functies, dedup logica, incrementele loads, CDC


VOORDAT JE BESTELT

Stuur me een bericht met een datavoorbeeld en hoe de output eruit moet zien. Ik vertel je welke package het beste past, of dat ik niet de juiste persoon ben. Het bepalen van de scope is gratis.


Ik werk in IST-tijd en heb overlapping met US en EU uren.

Bestemmingsplatform:

Google BigQuery

Amazon Redshift

ClickHouse

Tools & platforms:

Hevo Data

Kafka Connect

Debezium