Ik bouw een python etl pipeline en automatiseer je data-integratie
Over deze dienst
Heb je data verspreid over CSV-bestanden, Excel-sheets of API's die in een database moeten eindigen?
Ik bouw Python ETL-pipelines die je data extraheren, schoonmaken, valideren en laden in PostgreSQL, zodat je er in seconden query's op kunt uitvoeren in plaats van rijen handmatig te kopiëren.
WAT JE KRIJGT
Extractie uit CSV, Excel, API's of Google Sheets
Schoonmaken: duplicaten verwijderen, types corrigeren, ontbrekende waarden afhandelen
Validatie met Pandera (schema + bedrijfsregels)
Snel laden in PostgreSQL met behulp van het COPY-protocol
Docker-setup voor reproduceerbaarheid
Unit tests om te zorgen dat het werkt
Documentatie over hoe het te gebruiken
WAAROM MET MIJ WERKEN
Data engineering afgestudeerd (Kielce University of Technology)
Recente project: 9 tabellen, 1,5 miljoen rijen, geladen in 40 seconden, gevalideerd en getest
Volledige case study: https://anna1sheludko.github.io
HOE HET WERKT
1. Stuur me een bericht voordat je bestelt en vertel me over je data
2. Ik stuur je een kort plan met vragen
3. We stemmen de scope af en starten
Ik reageer binnen 24 uur.
Weet je niet welke package het beste past? Stuur me een bericht, ik vertel je eerlijk wat het beste is.
Taal:
Engels
•
Pools
•
Russisch
•
Overige
Technische expertise:
Apache Airflow
•
Overige
Branche:
Gegevensanalyse
Mijn portfolio
Veelgestelde vragen
Automatische vertaling
Met welke gegevensbronnen kunt u werken?
CSV-bestanden, Excel-spreadsheets, REST API's, Google Sheets, JSON-exporten en de meeste database-exporten. Als je data ergens anders staat, stuur me een bericht — ik vertel je of ik het kan verwerken.
Moet ik Python of SQL kennen?
Helemaal niet. Ik lever een werkend script en duidelijke documentatie. Je voert één commando uit en de rest gebeurt automatisch. Wil je begrijpen wat er gebeurt, dan leg ik het graag uit in eenvoudige taal.
Kun je data schoonmaken die al rommelig is?
Ja — dat is het meeste werk. Ik verwijder duplicaten, corrigeer datumnotaties en getalformaten, handel ontbrekende waarden af en standaardiseer tekst. Je krijgt een schone, gevalideerde dataset aan het eind, plus een kort rapport van wat er is veranderd.
Wat als ik niet weet welk pakket ik moet kiezen?
Stuur me een bericht met een korte beschrijving van je data voordat je bestelt. Ik vertel je eerlijk welke package het beste past — of dat geen enkele geschikt is, dat zeg ik ook.
Hoe ga je om met mijn data? Is het veilig?
Ik gebruik alleen de bestanden die je deelt voor de duur van het project, werk in een lokale omgeving (geen uploads naar derden) en verwijder alles na oplevering, tenzij je me vraagt het te bewaren. Ik ben bereid een NDA te ondertekenen als je data gevoelig is.
Bieden jullie gesprekken aan?
Nee, alle communicatie verloopt strikt via Fiverr chat.

