Ik bouw een ai saas met rag, embeddings en vector search


Over deze dienst
Automatische vertaling
De meeste AI-gigs verkopen je een wrapper rond een API-sleutel. Dit is een product: jouw eigen data, jouw eigen retrieval, jouw eigen app.
Ik bouw de hele stack. Documenten erin, embeddings en een vector index erachter, retrieval die bronnen teruggeeft, en een echte web app bovenop waar jouw klanten inloggen.
WAT JE KRIJGT
Ingestie voor PDFs, documenten, sites, Notion of je database
Chunking, embeddings en een afgestemde vector index
Antwoorden met citaties, zodat gebruikers de bron kunnen controleren
Streaming chat UI, authenticatie en document upload
Evals zodat je de kwaliteit kunt bewijzen in plaats van te gokken
Kosten- en tokenbeheer, plus rate limiting
Schoon TypeScript, gedocumenteerd, geïmplementeerd en van jou
STACK
Next.js, Node, TypeScript, pgvector, Pinecone, Qdrant, LangChain, de Claude en OpenAI APIs, Postgres, Stripe en Vercel
Ik heb 65 vijf-sterren reviews en ik bouw full stack, dus het AI-gedeelte wordt daadwerkelijk in een werkend product geleverd in plaats van een notitieboekje.
Vertel me welke data je wilt dat het antwoordt en ik vertel je of RAG überhaupt de juiste oplossing voor jou is.
Maak kennis met Abhinay Pandey
Professionally Personal
- Afkomstig uitIndia
- Lid sindsaug 2017
- Laatste levering8 maanden
Talen
Engels, Hindi
Automatische vertaling
Mijn portfolio
Andere AI-development diensten die ik aanbied
Veelgestelde vragen
Automatische vertaling
Hoe verschilt dit van een ChatGPT-wrapper?
Een wrapper stuurt je vraag rechtstreeks naar een API. Deze haalt eerst uit je eigen content, zodat antwoorden gebaseerd zijn op jouw data en hun bronnen citeren. Dat is het verschil tussen een demo en iets dat je voor klanten kunt gebruiken.
Welke model en vector database gebruik je?
Wat het beste past bij jouw data grootte, budget en privacybehoeften. Meestal Claude of OpenAI met pgvector als je al Postgres gebruikt, of Pinecone en Qdrant op grotere schaal. Ik leg de afweging uit voordat we beginnen, niet achteraf.
Wie betaalt de API- en hostingkosten?
Jij, op je eigen accounts, zodat er daarna geen afhankelijkheid van mij is. Ik bouw caching, tokenlimieten en rate limiting in zodat je factuur voorspelbaar blijft, en ik schat je maandelijkse kosten in voordat we starten.
