Ik los je rag of llm app op, evalueer en optimaliseer deze voor nauwkeurigheid en kosten

P
pulkit004
P
pulkit004
Pulkit V.
Sommige informatie is automatisch vertaald.

Over deze dienst

Automatische vertaling

Je AI-app werkt in de demo, maar crasht bij echte gebruikers: verkeerde antwoorden, hallucinaties, trage reacties, verrassende API-rekeningen. Ik kom erachter waarom en los het op.


Veelvoorkomende oplossingen:

  • Slechte retrieval: chunking, embeddings, hybride zoekopdrachten, reranking
  • Hallucinaties: grounding, citaties, weigeringgedrag
  • Prompt- en gestructureerde output-bugs (JSON die breekt)
  • Latency: streaming, caching, kleinere modellen waar ze goed genoeg zijn
  • Kosten: tokenbudgetten, model routing, prompt caching
  • Geen evals: ik zet een testset op zodat je kwaliteit meet in plaats van gokken


Werkt met LangChain, LlamaIndex, ruwe OpenAI/Claude SDKs, Vercel AI SDK, AWS Bedrock en n8n.


Waarom ik: Als Engineering Manager die AI-initiatieven leidt, heb ik productie RAG-pijplijnen en AI review agents uitgerold, en ik geef om de onzichtbare onderdelen: evals, failure cases en kosten per verzoek.


Stuur me een bericht met je stack en 3-5 voorbeelden van slechte outputs.

Maak kennis met Pulkit V.

Pulkit V.

Engineering Manager building production RAG and AI agents

  • Afkomstig uitIndia
  • Lid sindsjun 2017
  • Talen

    Hindi, Engels
I build AI systems that ship, not demos. Engineering Manager at Setu (Pine Labs), leading AI initiatives: production RAG pipelines, AI agents in engineering workflows, and LLM-powered insights. 8+ years building products as an engineer and tech lead. Founder of WeaveAI, an AI engineering studio. M.S. Data Science at the University of Pittsburgh. I deliver: RAG with citations, n8n automations and AI agents, Claude Code setups for dev teams, and fixes for LLM apps that hallucinate, lag, or cost too much. Evals included. Message me before ordering so we can scope it right.

Automatische vertaling

Mijn portfolio