Ik beoordeel de beveiliging van je ai-assistent
IT- en cybersecurityprofessional met meer dan 15 jaar ervaring
Over deze dienst
Je AI-assistent kan worden overgehaald tot dingen die je ontwikkelaars nooit bedoeld hebben: het lekken van zijn system prompt, het negeren van zijn guardrails, het oproepen van backend tools of het teruggeven van output die niet zou mogen. Guardrails die er in een demo solide uitzien, falen vaak onder een gerichte tegenstander. Daar test ik precies op.
Waar ik op test:
- Directe en indirecte prompt-injectie
- Jailbreaks en omzeiling van guardrail/veiligheidsfilter
- Leakage van system prompt en context/data
- Onveilige output-afhandeling (XSS, markdown/HTML-injectie, SSRF via tool calls)
- Misbruik van tool / functie-aanroepen / agent en overmatige macht
- RAG en databasource poisoning
- PII en gevoelige data blootstelling
- Wallet-ontkenning / kostenversterking misbruik
- Gaten in authenticatie en toegangscontrole rond de AI-functies
De methodologie volgt de OWASP Top 10 voor LLM-toepassingen en OWASP ASVS voor de weblaag eromheen, plus mijn eigen offensieve testplaybook.
Je krijgt een rapport met bevindingen inclusief ernstbeoordelingen, reproductiestappen en concrete remediëringsrichtlijnen die door je ontwikkelaars direct kunnen worden toegepast, niet alleen maar opgeslagen.
Apparaat:
Server / hosting
Levert ook:
Documentatie
Andere IT en ondersteuning diensten die ik aanbied
Veelgestelde vragen
Automatische vertaling
Heb je toegang tot broncode of modelgewichten nodig?
Nee. Ik werk standaard black-box — hetzelfde als een externe aanvaller. Grijze/witte-box review van de integratiecode is beschikbaar op de Full Engagement tier of als een aangepaste opdracht.
Kun je productie testen?
Ik adviseer een staging-omgeving. Als productie de enige optie is, coördineren we vooraf de timing en snelheidslimieten om impact te voorkomen.
Welke framework volg je?
OWASP Top 10 voor LLM-toepassingen voor de AI-laag, OWASP ASVS voor de webapplicatie eromheen, plus mijn eigen offensieve testmethodologie.
Krijg ik iets waar mijn ontwikkelaars mee kunnen werken?
Ja. Elke bevinding bevat ernst, reproductiestappen en specifieke remediëringsrichtlijnen — geen generieke scanner dump.
Behandel je ook compliance (bijv. SOC2)?
De bevindingen komen overeen met gangbare controls en ik kan relevante mappings aangeven, maar deze gigs zijn technische security assessments, geen formele compliance audits. Stuur me een bericht als je dat anders wilt laten kaderen.
Kun je na het oplossen van de issues opnieuw testen?
Ja — retesten is inbegrepen bij de Comprehensive en Full Engagement tiers.

