Ik zet private zelfgehoste AI op je server met ollama en open webui


Over deze dienst
Automatische vertaling
Je team wil ChatGPT-achtige AI. Je compliancebeleid zegt dat klantgegevens niet je controle mogen verlaten. Deze dienst lost beide op.
Ik zet een private AI-stack op - Ollama + Open WebUI - op je server of VPS. Prompt, chatgeschiedenis en documenten komen nooit in een derde partij cloud terecht. Gemaakt voor legaal, medisch en elk bedrijf met een no-cloud-AI beleid.
Elke tier bevat:
- Productie Docker deployment met HTTPS reverse proxy
- 2-3 open modellen geselecteerd en afgestemd op jouw hardware
- Geschreven admin gids: updates, backups, gebruikersbeheer
- Jij hebt alles in handen: configs, code, admin credentials
- Directe communicatie uit de VS
Standaard bevat RAG - jouw AI beantwoordt vragen op basis van jouw documenten - plus Tailscale veilige remote toegang voor je team. Premium voegt een OpenAI-compatibele API endpoint toe voor je andere software, gebruikersaccounts, een overdrachtgesprek en 14 dagen support.
Over mij: B.Sc. Elektrotechniek, tien jaar in de halfgeleiderindustrie. Ik draai deze stack 24/7 in productie op infrastructuur die ik zelf heb gebouwd en onderhoud - zelfgehoste LLMs, Docker services, VPN mesh netwerken, SIEM logging.
Ik ben niet de goedkoopste hier. Ik ben degene die het werk documenteert en je de sleutels geeft.
Maak kennis met Michael B
AI Automation Engineer, Private LLMs, Alerting, Network Security
- Afkomstig uitVerenigde Staten
- Lid sindsjan 2026
- Gem. reactietijd1 uur
Talen
Engels
Automatische vertaling
Andere AI-development diensten die ik aanbied
Veelgestelde vragen
Automatische vertaling
Waarom zouden we je vertrouwen met admin toegang tijdens de setup?
Ik kan via schermdeling werken zodat je elke stap kunt volgen. Jij geeft tijdelijke credentials en roteert alles bij overdracht; de docs laten precies zien wat waar draait. Alle software is open source en er wordt niets naar mij gebeld. NDA op verzoek - en ik kan mijn eigen live instance demonstreren voordat je bestelt.
Zijn er doorlopende API- of licentiekosten na levering?
Nee. Ollama, Open WebUI en LiteLLM zijn open source, en de modellen draaien op je eigen hardware. Er zijn geen kosten per token en geen abonnementen - je enige terugkerende kosten zijn de server zelf (energie of VPS huur).
Wat moet ik aanleveren?
Een Linux server of VPS (ik kan er een aanbevelen die past bij je budget), een manier om me toegang te geven (SSH sleutel of tijdelijke credentials), en een domeinnaam als je HTTPS op een publiek adres wilt. Voor Standard/Premium RAG, de documenten die je wilt dat de AI kent.
Welke hardware is hiervoor nodig?
Open WebUI draait bijna overal; model snelheid hangt af van RAM en GPU. Een moderne CPU met 16 GB RAM behandelt kleine modellen goed; een GPU maakt grotere modellen snel. Stuur me je specs (of budget) voor je bestelt en ik vertel je eerlijk wat je kunt verwachten qua prestaties.
Wat gebeurt er na de bevalling?
Elke tier wordt geleverd met een geschreven admin gids over updates, backups en gebruikersbeheer. Premium bevat een live overdrachtgesprek en 14 dagen support. Voortdurend onderhoud of latere upgrades - nieuwe modellen, meer gebruikers, API-integraties - zijn beschikbaar als maatwerk aanbiedingen.
Zal het net zo goed zijn als ChatGPT?
Voor het opstellen, samenvatten en Q&A over je eigen documenten doen de huidige open modellen (Llama, Qwen, Mistral) uitstekend werk. Frontier cloud modellen zijn nog sterker in moeilijk redeneren - de tradeoff die je koopt is totale data privacy. Ik match modellen eerlijk aan je use case.
