Prompt Injection Attacks

Latest papers 70

All topics
CardsList
  1. WebTrap: Stealthy Mid-Task Hijacking of Browser Agents During Navigation

    May 8, 2026Zhichao Liu, Wenbo Pan, Haining Yu +3Indirect Prompt InjectionPrompt Injection Attacks

  2. SafeReview: Defending LLM-based Review Systems Against Adversarial Hidden Prompts

    Apr 29, 2026Yuan Xin, Yixuan Weng, Minjun Zhu +5Adversarial TrainingAdversarial Prompt Generation

  3. Evaluation of Prompt Injection Defenses in Large Language Models

    Apr 26, 2026Priyal Deep, Shane Emmons, Amy Fox +4Data LeakagePrivacy Leakage in Language Models

  4. When AI reviews science: Can we trust the referee?

    Apr 26, 2026Jialiang Wang, Yuchen Liu, Hang Xu +7LLM AuditingAdversarial Attacks on LLMs

  5. Conjunctive Prompt Attacks in Multi-Agent LLM Systems

    Apr 17, 2026Nokimul Hasan Arif, Qian Lou, Mengxin ZhengMulti-Agent LLM SystemsAdversarial Attacks on LLMs

  6. Prompt Injection as Role Confusion

    Feb 22, 2026Charles Ye, Jasmine Cui, Dylan Hadfield-MenellAdversarial Attacks on LLMsPrompt Injection Attacks

  7. It's a TRAP! Task-Redirecting Agent Persuasion Benchmark for Web Agents

    Dec 29, 2025Karolina Korgul, Yushi Yang, Arkadiusz Drohomirecki +7Web Agent BenchmarksIndirect Prompt Injection

  8. "Give a Positive Review Only": An Early Investigation Into In-Paper Prompt Injection Attacks and Defenses for AI Reviewers

    Nov 3, 2025Qin Zhou, Zhexin Zhang, Zhi Li +1Adversarial Prompt GenerationIndirect Prompt Injection

  9. Red-Teaming Coding Agents from a Tool-Invocation Perspective: An Empirical Security Assessment

    Sep 6, 2025Yuchong Xie, Mingyu Luo, Zesen Liu +7Prompt InjectionAI Coding Agents