Ik doe data cleaning, preprocessing en data wrangling in python

Sommige informatie is automatisch vertaald.

Pakistan

Ik spreek Engels, Urdu, Punjabi, Hindi

Data Scientist die ML, Power BI, Statistiek, AI Apps bouwt

Welkom bij NeuronVision. Ik ben Muhammad, een MSc-gekwalificeerde Data Scientist die rommelige, complexe data omzet in beslissingen die je kunt vertrouwen en op kunt handelen. Wat ik lever: - ML & AI...
Over deze dienst

Rommelige, gedupliceerde, halflege data? Ik zet het om in schone, betrouwbare, analysis-klare tabellen.


Ik ben Muhammad, een MSc-gekwalificeerde data scientist en data engineer. Ik maak data schoon en structureer het zodat elke volgende stap, dashboards, modellen, rapporten, op iets kunnen rusten dat je kunt vertrouwen.


Wat ik doe:

  • Data cleaning: duplicaten, verkeerde types, ontbrekende waarden, inconsistente tekst
  • Wrangling en reshaping (Python/Pandas, SQL)
  • ETL pipelines: extract, transform, load uit meerdere bronnen
  • Veilig samenvoegen en koppelen van rommelige datasets
  • Feature en column engineering
  • Data validatie en kwaliteitscontroles
  • Medallion pipelines (brons-zilver-goud) en star-schema warehouses
  • PySpark voor grote datasets


Formaten: Excel, CSV, JSON, SQL databases en meer.


Waarom ik:

  • Reproduceerbare, gedocumenteerde pipelines, geen eenmalige hacks
  • Elke transformatie is traceerbaar en opnieuw uit te voeren
  • Zorgvuldige validatie zodat niets stilletjes kapot gaat
  • Snelle, vriendelijke communicatie


Recent werk omvat een medallion pipeline die 5.3x compressie behaalde met byte-identieke, volledig reproduceerbare builds over 11 modeling-klare tabellen.


Stuur me gerust een bericht voordat je bestelt met een voorbeeld van je data, zodat ik de scope en het juiste pakket kan bevestigen.

Expertise:

Big data

•

Gegevensmanipulatie

•

Data validatie

•

etl

Technologie:

Python

•

R

•

SQL

Mijn portfolio