Ik bouw realtime data pipelines met apache kafka, spark en aws

Sommige informatie is automatisch vertaald.

India

Ik spreek Engels

Gegevensingenieur

Ik ben een resultaatgerichte Data Engineer met meer dan 5 jaar ervaring in Big Data, AWS en technische leiding. Ik specialiseer me in het ontwerpen van grootschalige cloud-native pipelines en data lak...
Over deze dienst

PIPELINES DIE DE PRODUCTIE OVERLEVEN, NIET ALLEEN DE DEMO.


Ik bouw batch- en streaming data pipelines die elke dag draaien zonder dat iemand ze in de gaten houdt.


WAT IK LEVER

- Streaming ingestie: Kafka, Kinesis, RabbitMQ, NiFi, CDC van je database

- PySpark / Spark SQL transformaties, geoptimaliseerd - niet de standaardconfiguratie

- Data lake op S3 met Apache Iceberg: schema-evolutie, time travel, MERGE upserts

- Data warehouse laden in Redshift, Snowflake, Athena of BigQuery

- SCD Type 2 geschiedenis, deduplicatie, idempotente herhalingen, late data handling

- Airflow DAGs, retries, waarschuwingen en CloudWatch/Grafana dashboards

- CI/CD, tests en documentatie zodat het onderhoudbaar is


TRACK RECORD

Meer dan 3,5 jaar op het streaming platform van een Europese telecom: 100+ productie pipelines, 0,6 TB/dag (18 TB/maand), miljoenen gebruikers in 8 landen. Meer dan 50% minder compute tijd door 100+ PySpark jobs. 60% minder job failures. 99,9%+ uptime.


Ik heb ook een Redshift workload gemigreerd naar Apache Iceberg: queries 40%+ sneller en goedkoper.


Stuur me je bron, bestemming en volume. Je krijgt een vaste scope en een echte planning voordat je bestelt.


Taal:

Engels

•

Duits

•

Hindi

•

Sloveens

Technische expertise:

Apache NiFi

•

Apache Airflow

•

apache vonk

Expertise:

Datapijplijnen

•

ETL-ontwikkeling

Branche:

Audio en video

•

Gegevensanalyse

•

Financiële diensten

Mijn portfolio