Prompt Injection Attacks on AI Agents

Latest papers 108

All topics
CardsList
  1. Can a Single Message Paralyze the AI Infrastructure? The Rise of AbO-DDoS Attacks through Targeted Mobius Injection

    May 12, 2026Zi Liang, Ronghua Li, Yanyun Wang +2AI Agent SecurityLLM Agent Security

  2. Comment and Control: Hijacking Agentic Workflows via Context-Grounded Evolution

    May 11, 2026Neil Fendley, Zhengyu Liu, Aonan Guan +2Adversarial Attacks on LLMsAgentic Workflows

  3. AgentShield: Deception-based Compromise Detection for Tool-using LLM Agents

    May 10, 2026Yassin H. Rassul, Tarik A. RashidLLM Agent SecurityAI Agent Monitoring

  4. PropGuard: Safeguarding LLM-MAS via Propagation-Aware Exploration and Remediation

    May 8, 2026Bingyu Yan, Xiaoming Zhang, Jinyu Hou +4LLM Agent SecurityPrompt Injection Attacks on AI Agents

  5. LoopTrap: Termination Poisoning Attacks on LLM Agents

    May 7, 2026Huiyu Xu, Zhibo Wang, Wenhui Zhang +4Adversarial Attacks on LLMsLLM Red Teaming

  6. A Low-Latency Fraud Detection Layer for Detecting Adversarial Interaction Patterns in LLM-Powered Agents

    May 1, 2026Sheldon Yu, Yingcheng Sun, Hanqing Guo +1AI Agent SecurityLLM Agent Security

  7. Evaluation of Prompt Injection Defenses in Large Language Models

    Apr 26, 2026Priyal Deep, Shane Emmons, Amy Fox +4Data LeakagePrivacy Leakage in Language Models

  8. RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents

    Apr 24, 2026Wenjie Xiao, Xuehai Tang, Biyu Zhou +2LLM Agent SecurityPrompt Injection Attacks on LLMs

  9. Owner-Harm: A Missing Threat Model for AI Agent Safety

    Apr 20, 2026Dongcheng Zhang, Yiqing JiangAI Agent SecurityAI Agent Safety

  10. Conjunctive Prompt Attacks in Multi-Agent LLM Systems

    Apr 17, 2026Nokimul Hasan Arif, Qian Lou, Mengxin ZhengMulti-Agent LLM SystemsAdversarial Attacks on LLMs

  11. Prompt Injection as Role Confusion

    Feb 22, 2026Charles Ye, Jasmine Cui, Dylan Hadfield-MenellAdversarial Attacks on LLMsPrompt Injection Attacks

  12. It's a TRAP! Task-Redirecting Agent Persuasion Benchmark for Web Agents

    Dec 29, 2025Karolina Korgul, Yushi Yang, Arkadiusz Drohomirecki +7Web Agent BenchmarksIndirect Prompt Injection

  13. Red-Teaming Coding Agents from a Tool-Invocation Perspective: An Empirical Security Assessment

    Sep 6, 2025Yuchong Xie, Mingyu Luo, Zesen Liu +7Prompt InjectionAI Coding Agents

  14. Meta-SecAlign: Training LLMs against Prompt Injection for Robust Agents

    Jul 3, 2025Sizhe Chen, Arman Zharmagambetov, David Wagner +1LLM Agent SecurityAI Agent Security Benchmarks