Prompt Injection Detection

Latest papers 39

All topics
CardsList
  1. SnapGuard: Lightweight Prompt Injection Detection for Screenshot-Based Web Agents

    Apr 28, 2026Mengyao Du, Han Fang, Haokai Ma +4Indirect Prompt InjectionPrompt Injection Detection

  2. A Comparative Evaluation of AI Agent Security Guardrails

    Apr 27, 2026Qi Li, Jiu Li, Pingtao Wei +8LLM GuardrailsAI Agent Security

  3. RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents

    Apr 24, 2026Wenjie Xiao, Xuehai Tang, Biyu Zhou +2LLM Agent SecurityPrompt Injection Attacks on LLMs

  4. CASCADE: A Component Ablation and Corpus Audit of a Layered Local Defense for MCP-Based Systems

    Apr 18, 2026İpek Abasıkeleş Turgut, Edip GümüşMCP SecurityLLM Security

  5. "Give a Positive Review Only": An Early Investigation Into In-Paper Prompt Injection Attacks and Defenses for AI Reviewers

    Nov 3, 2025Qin Zhou, Zhexin Zhang, Zhi Li +1Adversarial Prompt GenerationIndirect Prompt Injection

  6. UniGuardian: A Unified Defense for Detecting Prompt Injection, Backdoor Attacks and Adversarial Attacks in Large Language Models

    Feb 18, 2025Huawei Lin, Yingjie Lao, Tony Geng +2LLM Backdoor AttacksAdversarial Attacks on LLMs