Ik bouw of optimaliseer pyspark databricks data pipelines

Sommige informatie is automatisch vertaald.

Verenigde Staten

Ik spreek Engels, Hindi

FullStack Agentic AI Systems Design en Automatisering, MLOps

Full-Stack AI/ML Engineer en Toegepaste Statisticus met 10 jaar ervaring in data, ML en enterprise AI. Ik bouw agentic workflows, RAG-systemen, voorspellende modellen, data pipelines, APIs en interne ...
Over deze dienst

Heb je een betrouwbare, schaalbare en begrijpelijke PySpark- of Databricks-pipeline nodig?


Ik beoordeel, bouw, repareer of optimaliseer een bounded data pipeline met behulp van PySpark, Spark SQL, Delta Lake en Azure Databricks waar nodig.


Ik kan trage jobs aanpakken, overmatige shuffles, join skew, partitionering, pruning, window functies, temporele functies, incrementeel verwerken, Delta Lake, data-kwaliteitscontroles en Python UDF refactoring.


Jouw levering kan bestaan uit gecorrigeerde code, prestatiebevindingen, pipeline-implementatie, validatiecontroles, benchmarkrichtlijnen, documentatie en een technische overdracht.


Mijn recente werk omvat gedistribueerde verwerking van meer dan miljarden package-network records in Azure Databricks zonder Python UDFs. Ik focus op uitlegbare, onderhoudbare verbeteringen.


Packages omvatten gedefinieerde jobs, bronnen en transformaties. Cloudkosten, productiecredentials, platformbeheer en niet-gerelateerde dashboards worden uitgesloten, tenzij opgenomen in een aangepaste aanbieding.


Stuur me een bericht voordat je bestelt met de code, schema's, datavolume, huidige runtime en gewenste resultaat.

Taal:

Engels

Hindi

Technische expertise:

apache vonk

Databricks

Snowflake

Expertise:

Datapijplijnen

ETL-ontwikkeling

Branche:

Gegevensanalyse

Juridisch

Marketing en adverteren

Mijn portfolio