Ik zet observability en alerting op

Sommige informatie is automatisch vertaald.

India

Ik spreek Engels, Hindi

SRE en DevOps specialist in Kubernetes, Terraform en Cloud

Ik ben een Staff Site Reliability Engineer met meer dan 12 jaar praktische ervaring in DevOps, cloud infrastructuur, Kubernetes, Terraform, CI/CD, observability, automatisering en productie betrouwbaa...
Over deze dienst

Wil je betrouwbare zichtbaarheid in je systemen, niet zomaar een dashboard? Ik zet een gebonden observability-oplossing op, verbeter deze of los problemen op voor een overeengekomen applicatie, service, workload, namespace of telemetry pipeline.

Een volledig Kubernetes-cluster is alleen inbegrepen als de grootte, workloads, telemetry bronnen en benodigde integraties passen bij het gekozen pakket en vooraf zijn overeengekomen.


Afhankelijk van het pakket en de afgesproken scope, kan ik helpen met:

  • Metrics, logs en traces verzamelen
  • OpenTelemetry, OTLP en Grafana Alloy configuratie
  • Grafana, Prometheus, Loki en Alertmanager integratie
  • Dashboards en bruikbare alerts
  • SLI en SLO definiëren
  • Ontbrekende telemetry, ruisende alerts en pipeline troubleshooting
  • Validatie, documentatie en overdracht

Ik ben een Staff Site Reliability Engineer met meer dan 12 jaar ervaring in DevOps en SRE. Mijn werk omvat productie observability, applicatie-instrumentatie, telemetry pipelines, incident response en betrouwbaarheidsevaluaties.

Elk pakket heeft vastgestelde limieten voor omgevingen, telemetry bronnen, dashboards, alerts en SLO's. Multi-omgeving, multi-cluster, productie-kritisch of grote bestaande platforms vereisen overleg voorafgaand aan bestellen.

Tools:

Docker

GitLab

Jenkins

GitHub

BitBucket

Kubernetes

Amazon EKS

Frameworks:

Terraform

Ansible

Cloudprovider:

Amazon Web Services

microsoft azure

Programmeertaal:

Bash

Python

Expertise:

Installatie

Ontwikkeling

Configuratie