Ik zet prometheus grafana monitoring en alerts voor je servers op
AWS DevOps en SRE, 7 jaar, Kubernetes CKA, Terraform, CICD
Over deze dienst
Erachter komen dat je server down was door een klant is niet de juiste manier om het te ontdekken. Laat mij monitoring instellen die je eerst waarschuwt.
Senior DevOps / SRE, meer dan 7 jaar ervaring bij Zoom, Airtel, Infosys en Mindtree. Ik doe de on-call voor meer dan 150 Linux hosts en multi-cluster EKS met meer dan 99% uptime, gebruikmakend van Prometheus, Grafana, Datadog en PagerDuty elke dag. Gecertificeerd: CKA, AWS Solutions Architect, AWS SysOps, Terraform.
WAT IK INSTEL
Prometheus met node exporter, cAdvisor en service exporters
Grafana dashboards die laten zien wat echt belangrijk is, niet 40 nutteloze panels
Alertmanager regels die naar Slack, e-mail of PagerDuty worden gestuurd
Loki voor gecentraliseerde logs, doorzoekbaar naast je metrics
Kubernetes monitoring: pods, nodes, deployments, resource druk
AWS CloudWatch alarms waar ze beter passen dan Prometheus
WAAROM HET BELANGRIJK IS
Alerts die constant afgaan worden genegeerd. Ik pas drempels aan zodat elke alert betekent dat er echt iets mis is en een menselijke tussenkomst vereist.
HOE IK WERK
Stap één: vertel me wat je runt en wat je eerder heeft gekwetst.
Stap twee: ik bevestig de scope en waar je op moet alerten. Overleg is gratis.
Stap drie: werkende stack, afgestemde alerts en een runbook per alert.
Stuur me een bericht met je setup voor een gratis consult.
Tools:
Docker
•
Kubernetes
•
Amazon EKS
•
Overige
Frameworks:
Terraform
•
Ansible
Cloudprovider:
Amazon Web Services
Programmeertaal:
Bash
•
Python
Expertise:
Installatie
•
Debuggen
•
Configuratie

