Ik monitor en debug je databricks en pyspark data pipelines

Sommige informatie is automatisch vertaald.

Bhutan

Ik spreek Engels

Gegevensingenieur

Ik ben een professionele Data en Software Engineer met een bewezen staat van dienst in het bouwen van robuuste data-architecturen en maatwerk softwareoplossingen. Met ervaring in het leiden van nation...
Over deze dienst

Werpt je data pipeline stille fouten, loopt hij traag, of breekt hij zonder waarschuwing in productie? Ik diagnoseer en los deze problemen snel op.


Ik ben een data engineer die dagelijks een live multi-client Databricks lakehouse omgeving runt. Ik weet hoe het eruitziet als een pipeline echt gezond is versus wanneer hij stilletjes problemen opstapelt die later leiden tot een groter incident.


Wat ik voor je kan doen:

  • Een bestaande pipeline controleren op knelpunten, stille fouten en betrouwbaarheidrisico's
  • - Een specifiek falend of onderpresterend job debuggen (Databricks, PySpark, Spark SQL)
  • - Monitoring, alerting en logging opzetten zodat problemen worden opgemerkt voordat ze uitvallen
  • - Aanbevelingen doen voor fixes in schema ontwerp, partitionering of job structuur die vertragingen veroorzaken
  • - Uitleggen wat er mis is in eenvoudige taal, niet alleen een technische dump

Dit is geen volledige pipeline herbouw service, het is gerichte diagnostiek en fix werk. Als je pipeline vanaf nul opgebouwd moet worden, kijk dan naar mijn andere gig daarvoor.


Stuur me een bericht met wat er misgaat (fouten, trage runs, onduidelijk gedrag) en ik vertel je eerlijk of ik kan helpen voordat je bestelt.

Taal:

Engels

Technische expertise:

Apache Airflow

•

apache vonk

•

Databricks

Expertise:

Datapijplijnen

Branche:

Gegevensanalyse

•

Financiële diensten

Andere Data engineering diensten die ik aanbied