Ik bouw een ai chatbot met behulp van llm, rag en vector database

J
jiuban1
J
jiuban1
zhumingming
Sommige informatie is automatisch vertaald.

Over deze dienst

Automatische vertaling

Hoi! Ik ben een full-stack ontwikkelaar die gespecialiseerd is in AI chatbots en LLM-integratie, met meer dan 3 jaar ervaring.


Ik heb mijn eigen machine learning platform (njmaet) gebouwd en 35B-parameter MoE-modellen ingezet op 8-GPU servers voor zakelijke klanten. Ik weet hoe AI-systemen werken van begin tot eind: van modelkeuze tot productie-implementatie.

WAT IK VOOR JOU BOUW:


1. AI Chatbots GPT, Claude of open-source modellen (Llama, Qwen, DeepSeek) geïntegreerd in jouw website of app

2. RAG Chatbots een chatbot die antwoord geeft vanuit JOUW documenten (PDF, website, database) met vector search (Milvus, Faiss)

3. Aangepaste AI assistenten die getraind zijn op jouw data, in de stem van jouw merk


WAAROM MET MIJ WERKEN:


  • Ervaring in productie: ik zet LLMs (7B-70B) in op GPU-servers met vLLM en Ollama
  • Full-stack: jouw chatbot krijgt een nette webinterface (Node.js + React), niet alleen een script
  • Ik regel APIs, databases, deployment en documentatie
  • Duidelijke communicatie, op tijd leveren


HOE HET WERKT:

1. Stuur me een bericht met een beschrijving van jouw project

2. Ik reageer met een plan, planning en het juiste pakket voor jou

3. Je krijgt updates over de voortgang tot aan de oplevering


Vragen? Stuur een bericht

Maak kennis met zhumingming

zhumingming

Full Stack Developer and AI LLM Deployment Specialist

  • Afkomstig uitChina
  • Lid sindsokt 2026
  • Gem. reactietijd1 uur
  • Talen

    Chinees, Engels
Full-stack developer, 3+ years in web dev and AI/ML deployment. • Full-Stack: Node.js + React, PostgreSQL/MongoDB, APIs, dashboards • AI Deployment: LLMs (7B-70B) on GPU servers via vLLM, Ollama • Fine-tuning: QLoRA/LoRA on custom datasets • AI Integration: RAG, vector DBs (Milvus/Faiss), chatbots, MCP connectors Built a dedicated ML platform (njmaet) from scratch, and deployed 35B MoE models on 8-GPU servers for enterprise clients. From training to production — I handle it all. Reliable, on time. Let's discuss your project!

Automatische vertaling