Ik doe data engineering en big data
Gegevensingenieur
Over deze dienst
Ik bouw een aangepaste ETL/ELT data pipeline met Python en SQL om je data te extraheren, transformeren, valideren en laden in databases of cloud data warehouses zoals BigQuery. De pipeline bevat basiscontroles op data kwaliteit, unittests en duidelijke documentatie.
Tools & platforms:
Google Cloud Dataflow
Veelgestelde vragen
Automatische vertaling
Welke informatie heb je nodig om het project te starten?
Ik heb toegang nodig tot de data bron of een voorbeeld dataset, de gewenste bestemming, en een korte beschrijving van de verwachte transformaties of zakelijke vereisten. Deel geen gevoelige inloggegevens direct in de Fiverr chat.
Welke data bronnen en bestemmingen ondersteun je?
Ik werk met databases en cloudservices zoals PostgreSQL, MySQL, BigQuery en Google Cloud Storage. Ik kan ook werken met gestructureerde bestanden zoals CSV en JSON.
Bied je ETL en ELT pipelines aan?
Ja. Ik ontwerp zowel ETL als ELT workflows, afhankelijk van jouw data architectuur, vereisten en doelplatform.
Bevat de pipeline data kwaliteit checks?
Ja. Het Basic pakket bevat basisvalidaties zoals null-waarde controles, detectie van duplicaten, validatie van datatypes en eenvoudige schema- of waardevalidaties.
Zal de pipeline tests en documentatie bevatten?
Ja. De pipeline bevat basis unittests en documentatie die het opzetten, afhankelijkheden, configuratie en uitvoeringsproces uitleggen.
Kun je de pipeline verbinden met mijn bestaande database of cloud omgeving?
Ja, mits de benodigde toegang en verbindingsinformatie beschikbaar zijn. De exacte implementatie hangt af van de bron, bestemming en projectvereisten.
