Ik zet claude code ai agents op je vps met docker
Senior DevOps en Netwerkbeveiligingsingenieur en Linux Expert
Over deze dienst
Ik draai al jaren productie Linux-servers. Het opzetten van AI agents is niet zomaar "docker run"; het gaat erom dat ze overleven herstarts, crashes verwerken, veilig blijven en je GPU-kosten niet laten exploderen.
Wat je krijgt:
Dockerized agent Claude Code, OpenHands, AutoGen, of je eigen Python/TypeScript agent, multi-stage build, niet als root, health checks
Systemd service Start bij opstart, herstart bij crash, resource limieten (CPU/RAM/GPU), logrotatie via journald
Nginx reverse proxy TLS (Let's Encrypt automatische vernieuwing), WebSocket ondersteuning voor streaming, rate limiting, basis authenticatie optie
Redis queue Taak wachtrij met prioriteit, retry/backoff, dead-letter handling (Standard/Premium)
Observability Loki + Promtail voor logs, Prometheus metrics (wachtrij diepte, latency, token gebruik), Grafana dashboard
Vector DB Qdrant/Weaviate voor RAG agents, persistent volume, backup cron (Premium)
Cost guard Dagelijkse uitgaven alert (Discord/Slack/Email), automatische shutdown bij budgetoverschrijding (Premium)
Runbook Architectuur, schaalgids, "agent vast?" troubleshooting, credential rotatie procedure
Stack die ik dagelijks gebruik: Docker, Nginx, systemd, Redis, Loki/Prometheus/Grafana, Qdrant, NVIDIA Container Toolkit, RunPod/Vast.ai/Lambda APIs, Linux
Mijn portfolio
Andere DevOps-techniek diensten die ik aanbied
Veelgestelde vragen
Automatische vertaling
Welke agents ondersteun je?
Claude Code, OpenHands, AutoGen, CrewAI, LangGraph, aangepaste Python/Node agents. Elke containeriseerbare agent werkt. Stuur me een bericht met je repo — ik bevestig de compatibiliteit.
Hoe ga je om met API-sleutels / geheimen?
Nooit in image of compose. Opties: 1) HashiCorp Vault, 2) 1Password CLI, 3) SOPS/age versleutelde bestanden, 4) Docker secrets (swarm), 5) GitHub Environments (CI/CD). We kiezen wat het beste past bij jouw workflow.
Kun je GPU-kosten optimaliseren?
Alleen Premium: Dagelijkse uitgaven alerts (Slack/Discord/Email), idle agents automatisch uitschakelen, fallback naar spot instances (RunPod/Vast.ai), token gebruik per agent bijhouden. Gemiddeld bespaar je 40-60% ten opzichte van altijd aan staan.

