Ik bouw gegevenswarehouse en optimaliseer BigQuery ETL-pijplijnen op Google Cloud
Over deze dienst
Ik bouw je Google Cloud gegevenspijplijnen en verlaag je BigQuery kosten.
Ik ben een data engineer die de volledige BigQuery stack in productie heeft draaien, momenteel als Lead/Senior Data Engineer, waar ik de maandelijkse BigQuery-uitgaven met 96% heb verminderd (van $13K naar $500) terwijl het query volume verdrievoudigde, door schema's te herontwerpen en queries te optimaliseren.
Wat ik doe:
- ETL-pijplijnen bouwen naar BigQuery vanuit APIs, GA4/Firebase exports, GCS of databases
- GA4, Firebase, Adjust, RevenueCat, Google Ads samenvoegen in één BigQuery-model
- BigQuery-kosten verlagen door schema's te herzien, partitionering/clustering, query-optimalisatie
- Geplande orkestratie instellen (Airflow, Cloud Composer, Pub/Sub)
- Transformatielagen bouwen met Dataform
- Rapportage-workflows automatiseren met Python en APIs
- Billing Kill Switches per project opzetten
- Data warehouse en data lakes creëren en optimaliseren
- Dashboards direct vanuit het warehouse bouwen
Hoe ik werk: je deelt read access tot GCP, ik controleer pipeline/query kosten, ik bouw of refactor en valideer, je krijgt documentatie en een overdracht-gesprek.
Tools: GCP, BigQuery, Cloud Storage, Pub/Sub, Airflow, Dataform, GA4, Firebase, SQL, Python.
- Stuur me eerst een bericht als je setup niet standaard is.
Taal:
Engels
Technische expertise:
Google BigQuery
Branche:
Gegevensanalyse
Veelgestelde vragen
Automatische vertaling
Heb je billing/admin toegang nodig tot mijn GCP-project?
Nee, ik heb alleen de specifieke IAM-rollen nodig voor het werk dat binnen de scope valt (bijvoorbeeld BigQuery Data Editor, Job User). Ik vertel je precies wat je moet geven.
Kun je een specifiek % kostenreductie garanderen?
Elke omgeving is anders, dus ik beloof geen getal voordat ik je daadwerkelijke querypatronen en schema heb geaudit — maar kostenreductie is meestal het eerste waar ik naar kijk.
Werk je met tools buiten de Google stack (AWS, Snowflake, dbt)?
Mijn diepste expertise ligt bij GCP/BigQuery, maar ik ben comfortabel met algemene ETL/orkestratiepatronen. Stuur me een bericht als je stack gemengd is.
Kun je dit zo instellen dat het zonder mijn tussenkomst blijft draaien?
Ja, de pakketten Standaard en Premium bevatten geplande orkestratie zodat pijplijnen automatisch draaien.

