Ik repareer, debug en optimaliseer je rag-pipeline of ai-chatbot


Over deze dienst
Automatische vertaling
Je RAG-pipeline of LLM-chatbot werkt in de demo, maar faalt bij echte gebruikers. Verkeerde chunks worden opgehaald, hallucinerende antwoorden, trage reacties, stijgende API-kosten. Ik los dat op.
Ik ben een AI-engineer die een productie RAG-systeem onderhoudt met duizenden documenten, live op Google Cloud en dagelijks in gebruik door echte gebruikers. Ik heb elk falingsmechanisme dat deze gig behandelt, meegemaakt.
Wat ik repareer:
- Slechte retrieval: chunking-strategie, embeddings, hybride zoekmethoden, reranking
- Hallucinaties: grounding, citaties, promptstructuur
- Latency en kosten: caching, modelkeuze, batching
- Ingestieproblemen: PDFs, gescrapete data, rommelige documenten
- Gebrek aan zichtbaarheid: evaluatie-instellingen zodat de kwaliteit meetbaar is
Stacks: LangChain, LlamaIndex, aangepaste pipelines, OpenAI, Gemini, Claude, Pinecone, Qdrant, pgvector, Vertex AI Vector Search, FastAPI, GCP, AWS.
Hoe het werkt: je deelt je repo of beschrijft je setup, ik doe een audit en je krijgt een schriftelijke diagnose met prioritaire fixes. Bij Standard en Premium implementeer ik de fixes en bewijs ik de verbetering met voor- en na-tests.
Jij bezit alle code. NDA op aanvraag. Stuur me een bericht voordat je bestelt, zodat ik de scope kan bevestigen.
Maak kennis met Muhammad Azeem
- Afkomstig uitPakistan
- Lid sindsjun 2025
- Gem. reactietijd1 uur
Talen
Engels
Automatische vertaling

