Ik bouw een voorspellingsmodel met volledige statistische validatie

Sommige informatie is automatisch vertaald.

Costa Rica

Ik spreek Spaans, Engels

Data scientist

Statisticus met ervaring in elk analytisch proces dat nodig is, van data cleaning, transformatie, beschrijvende statistieken, modellering tot het delen van inzichten. Gespecialiseerd in statistische m...
Over deze dienst

Code uitvoeren om een model te passen en wat resultaten te krijgen is niet moeilijk, maar dat is zinloos als je er niet op kunt vertrouwen.


De meeste "Data analisten" kunnen alleen modellen aanpassen, maar begrijpen niet de wiskundige en algoritmische achter-de-schermen processen die plaatsvinden om tot een uiteindelijke voorspelling te komen.


Ik bouw supervised machine learning modellen (classificatie of regressie) met de statistische strengheid die betrouwbare voorspellingen scheidt van misleidende. Dit betekent juiste validatie, eerlijke prestatie-rapportage en resultaten die je daadwerkelijk aan stakeholders kunt uitleggen.


Mijn doel is het leveren van een model dat je kunt inzetten, verdedigen en waarop je beslissingen kunt baseren, niet alleen het leveren van de beste metriek op de training- of testset.


Wat er inbegrepen is: Elke stap en techniek die nodig is om een betrouwbaar model te krijgen met jouw data, dit kan onder meer bestaan uit data schoonmaken en voorbereiden, een exploratieve analyse, categorische codering, ... tot het passen, valideren en afstemmen van het model om het robuust te maken.


Ik werk in Python of R, en zal schone, goed commentaar gevende en reproduceerbare code presenteren.

Expertise:

Representatieleren

Classificatie

Churn

clustering

Programmeertaal:

Python

R

SQL

Frameworks:

Scikit-learn

keras

PyTorch

Panda

Tools:

Jupyter-notitieboek

tensorflow

Excel

RStudio