Ik test je ai chatbot op hallucinaties en prompt-fouten
Python Automatisering Ontwikkelaar, Excel Data Verwerking Expert
Over deze dienst
Geeft je AI chatbot onjuiste, inconsistente of niet-helpende antwoorden?
Ik test je AI chatbot, LLM app of documentgebaseerde assistent voordat gebruikers de problemen ontdekken.
Ik kan controleren:
Hallucinaties en niet-ondersteunde claims
Prompt- en instructiefouten
Consistentie in multi-turn gesprekken
Onjuiste weigeringen en overconfidente antwoorden
RAG grounding wanneer bronnen worden aangeleverd
Respons duidelijkheid, toon en UX
Gedrag op desktop en mobiel indien van toepassing
Je rapport bevat:
Testprompt of gesprekscenario
Werkelijke reactie
Verwacht gedrag of referentie
Probleembeschrijving en ernst
Screenshots of opnames
Praktische verbeteringssuggesties
Scope van het pakket:
Basis: 10 prompts in 1 flow
Standaard: 30 prompts over maximaal 3 flows
Premium: 60 prompts over maximaal 6 flows plus één hertest
Geef alsjeblieft toegang tot chatbot, tijdelijke testgegevens indien nodig, doelgebruikers, belangrijke flows en verwachte antwoorden of referentiedocumenten.
Deze Gig omvat geen broncodewijzigingen, penetratietests, load testing of medische, juridische of financiële certificering.
Alleen geautoriseerde chatbots worden getest.
Testapplicatie:
Overige
Apparaat:
PC
•
iPhone
Veelgestelde vragen
Automatische vertaling
Hoe verschilt dit van normaal software testen?
Ik test zowel de interface als de kwaliteit van AI-antwoorden, inclusief hallucinaties, instructievolging, consistentie, weigeringen, bruikbaarheid en multi-turn gedrag.
Kun je een RAG of documentgebaseerde chatbot testen?
Ja. Geef de goedgekeurde referentiedocumenten door. Ik controleer of antwoorden gebaseerd zijn op de aangeleverde inhoud en markeer niet-ondersteunde claims.
Moet ik verwachte antwoorden aanleveren?
Verwachte antwoorden zijn handig voor domeinspecifiek testen. Anders, geef beleid, voorbeelden, bron documenten en het gedrag dat je van de chatbot verwacht.
Bied je prompt-injectie of jailbreak testen aan?
Ik kan basis robuustheid van prompts en weigering-gedrag controleren. Deze Gig omvat geen penetratietests, kwetsbaarhedenscans of formele security audits.
Kun je garanderen dat mijn chatbot nooit zal hallucineren?
Niemand kan zero hallucinaties garanderen voor elke mogelijke input. Ik bied een scope-evaluatie die herhaalbare zwaktes opspoort en manieren suggereert om risico te verminderen.

