Ik bouw geautomatiseerde ETL-pipelines met Python en SQL
Business Intelligence engineer
Over deze dienst
Organisaties kunnen moeite hebben met rommelige data die verspreid is over verschillende systemen. In mijn dagelijkse werk ben ik verantwoordelijk voor het overbruggen van die kloof, het ontwerpen van de analytische laag van het bedrijf en het volledig beheren ervan. Ik hoop kleinere bedrijven of zelfstandigen te helpen hetzelfde te bereiken.
Wat ik aanbied:
- Haal je data uit APIs, databases, spreadsheets of bestanden REST, JSON, SQL Server, Postgres, MySQL, BigQuery, Redshift
- Maak het schoon, los entiteiten op over systemen waar identifiers verschillen, en valideer het
- Model het goed zodat de cijfers standhouden onder vragen
- Automatiseer het: dagelijkse incrementele loads, idempotente upserts, rollback bij elke write
- Build de Power BI dashboard er bovenop als je dat wilt
Stack: Python, geavanceerd SQL, PySpark, dbt, Databricks, Microsoft Fabric, AWS, Power BI.
Vertel me wat je probeert te bereiken en we kunnen vanaf daar verder werken!
Technologie:
Python
•
SQL
Veelgestelde vragen
Automatische vertaling
Wat heb je van mij nodig om te beginnen?
Toegang tot of voorbeeldbestanden van je bronnen, en een beschrijving van wat je aan het einde wilt zien. Als het een API is, inloggegevens of documentatie. Ik bevestig de scope voordat je bestelt.
Gaat dit automatisch draaien nadat je hebt geleverd?
Bij Standard en Premium wel — je krijgt een geplande refresh script en setup documentatie. Basic is een eenmalige schone extractie.
Krijg ik de broncode?
Inbegrepen bij Standard en Premium. Als extra beschikbaar bij Basic.
Mijn data is rommelig en inconsistent over systemen. Is dat een probleem?
Nee, dat is de normale situatie. Cross-system entity resolution waar identifiers niet matchen, is een routine onderdeel van het werk.
