Ik schrijf python data validatie en kwaliteitscontroles voor je etl-pipeline

Sommige informatie is automatisch vertaald.

Taiwan

Ik spreek Chinees, Engels

AI Voice Cloning in Mandarin, automatisering en datastromen

Software engineer & data pipeline bouwer uit Taiwan. Ik run een eenmans AI-studio (SonarCue) gespecialiseerd in AI stem cloning met natuurlijke Mandarin/Chinese output, plus automatisering en datastro...
Over deze dienst

Stop stille data fouten: geautomatiseerde Python + pytest controles die de mislukkingen vangen die je logs "success" noemen.


Pipelines crashen zelden, ze geven stilletjes verkeerde data terug, zoals een API die een lege lijst teruggeeft terwijl de logs aangeven dat het gelukt is. Ik bouw de controles die die patronen opvangen.


WAT JE KRIJGT

- Een bevindingenrapport over issues in scope, met bewijs en repro-stappen

- Aangepaste controles in Python (Pandas + pytest), volledige broncode, jou om te behouden

- Premium: een GitHub Actions workflow voor één repo, plus een failure runbook


CONTROLES DEKKEN: versheid, volledigheid, schema drift, cross-source consistentie, nauwkeurigheid van failure-staat.


SCOPE

- 1 Data bron = 1 CSV/JSON bestand, 1 tabel of view, of 1 API endpoint met één schema. Controleer dat counts de totalen per order zijn.

- Revisies: één ronde op de oorspronkelijk afgesproken data. Nieuwe bronnen of regels: een Custom Offer.


Gebouwd uit 32 gedocumenteerde echte failures van het draaien van mijn eigen data systemen sample cases op GitHub; een Sample Findings Report staat in de gallery.


GEEN BEL- of video calls, alles schriftelijk via Fiverr. Geen DB-inloggegevens voor Basic/Standard: stuur een datavoorbeeld of een URL van een openbare endpoint.


Een software engineering dienst waarin ik niet adviseer over wat je data betekent voor je bedrijf.

Taal:

Chinees (vereenvoudigd)

Engels

Technische expertise:

Overige

Expertise:

Datapijplijnen

Data regulering

Branche:

Gegevensanalyse

Financiële diensten