Ik auditeer je ai-agent op prompt-injectie en beveiligingsrisico's


Level 1
Over deze dienst
Automatische vertaling
Is je AI-agent veilig om voor echte gebruikers te zetten? De meeste AI-agenten worden geleverd zonder prompt-injectie tests, wat betekent dat iedereen je chatbot kan misleiden om instructies te negeren, je systeem prompt te lekken of acties uit te voeren die niet mogen.
Ik voer een volledige AI-agent beveiligings audit uit: prompt-injectie pogingen, jailbreak testen, datalekken controleren en misbruik van API/tool-aanroepen, dezelfde technieken die een kwaadwillende gebruiker zou proberen, maar dan gedocumenteerd zodat je ze kunt oplossen voordat ze worden uitgebuit.
Wat wordt gedekt:
- LLM beveiligingsaudit: systeem prompt lekken, instructie overschrijven, jailbreak weerstand
- Prompt-injectie testen: directe en indirecte injectie via gebruikersinvoer, documenten of tool-uitvoer
- AI red teaming: adversarial testing tegen de daadwerkelijke tool-aanroepen en permissies van je agent
- Kwetsbaarheidstesten voor API-sleutels, onveilig tool-toegang en overmatige permissies van de agent
- Een schriftelijk rapport met een rangorde van bevindingen op ernst, inclusief fix-aanbevelingen
Achtergrond: 2+ jaar ervaring in Python backend en LLM/GenAI engineering, RAG pipelines en AI-automatisering bij meer dan 30 freelance projecten.
Stuur me toegang tot je agent (of een sandboxed/demo versie) en ik bepaal de scope van de audit voordat ik begin.
Maak kennis met Anchal
AI ML Developer: NLP Generative AI RAG and Automation Expert
Level 1
- Afkomstig uitIndia
- Lid sindsjul 2024
- Gem. reactietijd1 uur
- Laatste levering2 weken
Talen
Hindi, Engels
Automatische vertaling
Mijn portfolio
Andere Software development diensten die ik aanbied
Veelgestelde vragen
Automatische vertaling
Heb je volledige toegang nodig tot mijn systeem, of kan ik een sandboxed versie geven?
Een sandboxed of demo versie is prima — ik heb geen toegang tot productie of je echte gebruikersgegevens nodig om de audit uit te voeren.
Ga je echt proberen mijn agent te breken, of alleen de code beoordelen?
Beide. Ik test het zoals een aanvaller zou (live prompt-injectie pogingen) en beoordeel de onderliggende prompt/permissie-instellingen, omdat echte kwetsbaarheden vaak in beide liggen.
Wat als je een kritisch probleem vindt — repareer je dat ook?
Basic en Standard dekken alleen de audit en rapportage. Premium omvat het implementeren van guardrails om gevonden problemen op te lossen. Als er iets kritiek wordt gevonden in Basic/Standard, meld ik dat meteen in plaats van te wachten op de levering.
