Ik auditeer je rag-systeem en verminder hallucinaties

R
royxforge
R
royxforge
Sourav Roy
Sommige informatie is automatisch vertaald.

Over deze dienst

Automatische vertaling

Ik audit je RAG-systeem en laat je precies zien waar het faalt met cijfers.


Ik ben een AI-engineer met 3 onderzoekspapers en productie RAG-systemen in de gezondheidszorg, onderwijs en verkoop. Ik heb een open-source evaluatiekader gebouwd dat 6 dimensies beoordeelt: trouw, hallucinatiepercentage, retrieval precisie, relevantie van antwoorden, contextdekking en een labelvrije confidence metric (UCM) die geen ground-truth labels nodig heeft.


WAT JE KRIJGT:

- Evaluatie op je echte queries (OpenAI, Anthropic, Llama of elke andere provider)

- Hallucinatiepercentage + trouwscores, gerangschikt op ernst

- Oorzaken: chunking, retrieval, prompts, reranking

- Prioriteit voor verbeteringsplan


Standaard levert een volledige 6-dimensionale benchmarkrapport. Premium voert de fixes door en herhaalt de evaluatie om voor/na cijfers te tonen.


Werkt met LangChain, LlamaIndex, FastAPI, vector DBs (Pinecone, Chroma, FAISS, Weaviate).


Stuur je repo/docs en ik begin binnen 24 uur.


Maak kennis met Sourav Roy

Sourav Roy

AIML Engineer

  • Afkomstig uitIndia
  • Lid sindsjun 2026
  • Gem. reactietijd1 uur
  • Talen

    Bengaals, Hindi, Engels, Italiaans
I am an AI/ML Engineer with three published research papers and experience building production systems in healthcare, education, and sales. I architect end-to-end pipelines involving LLM orchestration, RAG, and neural model calibration. My focus is on creating robust, scalable AI infrastructure that bridges the gap between applied research and real-world reliability.

Automatische vertaling