Ik auditeer je rag-systeem en verminder hallucinaties


Over deze dienst
Automatische vertaling
Ik audit je RAG-systeem en laat je precies zien waar het faalt met cijfers.
Ik ben een AI-engineer met 3 onderzoekspapers en productie RAG-systemen in de gezondheidszorg, onderwijs en verkoop. Ik heb een open-source evaluatiekader gebouwd dat 6 dimensies beoordeelt: trouw, hallucinatiepercentage, retrieval precisie, relevantie van antwoorden, contextdekking en een labelvrije confidence metric (UCM) die geen ground-truth labels nodig heeft.
WAT JE KRIJGT:
- Evaluatie op je echte queries (OpenAI, Anthropic, Llama of elke andere provider)
- Hallucinatiepercentage + trouwscores, gerangschikt op ernst
- Oorzaken: chunking, retrieval, prompts, reranking
- Prioriteit voor verbeteringsplan
Standaard levert een volledige 6-dimensionale benchmarkrapport. Premium voert de fixes door en herhaalt de evaluatie om voor/na cijfers te tonen.
Werkt met LangChain, LlamaIndex, FastAPI, vector DBs (Pinecone, Chroma, FAISS, Weaviate).
Stuur je repo/docs en ik begin binnen 24 uur.
Maak kennis met Sourav Roy
AIML Engineer
- Afkomstig uitIndia
- Lid sindsjun 2026
- Gem. reactietijd1 uur
Talen
Bengaals, Hindi, Engels, Italiaans
Automatische vertaling

