Ik doe een red team-test op je llm-agent voor prompt-injectie en geheugenaanvallen

S
sidharth1
S
sidharth1
Sidharth P
Sommige informatie is automatisch vertaald.

Over deze dienst

Automatische vertaling

Is je LLM-agent veilig om voor echte gebruikers te zetten? Ik val het aan zoals een echte tegenstander dat zou doen en vertel je precies wat er kapot gaat en hoe je het kunt oplossen.


Ik ben een AI-veiligheidsonderzoeker met publicaties op ICML en IJCNLP en arXiv-werk over geheugenaanvallen tegen LLM-agents. Ik heb ook LLM-judge evaluatiebenchmarks ontwikkeld, zodat mijn tests systematisch en reproduceerbaar zijn, niet slechts een paar slimme prompts.


Wat ik test:

  • Prompt-injectie (direct en via documenten, webpagina’s of tool-uitvoer)
  • Jailbreaks en beleidsdoorbrekingen
  • Misbruik van tools en functie-aanroepen
  • Geheugen- en contextvergiftiging bij agents met langetermijngeheugen
  • Systeemprompt en datalekken


Wat je krijgt:

Een duidelijk geschreven rapport met elke bevinding, een reproduceerbaar voorbeeld, een ernstingsrating en een concrete oplossing. Hogere pakketten voegen de aanvalssuite als code toe zodat je het opnieuw kunt uitvoeren, plus een retest na je patch.


Werkt met OpenAI, Anthropic, open-source modellen, LangChain, LlamaIndex en aangepaste agent stacks. Stuur me eerst een bericht met een korte beschrijving van je agent en ik bevestig de scope. Ik test alleen systemen die jij bezit of waarvoor je toestemming hebt.

Maak kennis met Sidharth P

Sidharth P

AI Safety Researcher and LLM Fine Tuning Expert

  • Afkomstig uitIndia
  • Lid sindsapr 2017
  • Talen

    Telugu, Engels, Hindi
AI researcher in LLM safety and NLP. Research Intern at AI4Bharat (first author of IndicBERT-v3, open multilingual encoder LLMs) and Research Fellow at SPAR. Papers at ICML 2026 and IJCNLP-AACL 2025, plus arXiv work on memory attacks against LLM agents. Hands-on with LoRA/QLoRA and full fine-tuning (SFT, GRPO), multi-GPU training on H100s, vLLM/SGLang inference and LLM-as-judge evaluation. I help teams fine-tune open-source LLMs, build evaluation pipelines, red-team LLM agents and reproduce ML papers. Message me your goal and I will reply with a clear plan.

Automatische vertaling

Mijn portfolio

Andere AI-development diensten die ik aanbied

Gerelateerde tags