Prompt Injection Attacks

Latest papers 70

All topics
CardsList
  1. Hidden in the Comments: A Context-Injection Attack Surface in Code LLMs

    Oct 4, 2026Noor Munir, Francesco Quinzan, Stephen RobertsLLM SecurityIndirect Prompt Injection

  2. Hidden Risks of Jev: An Empirical Study of Security, Privacy, and Dual Use

    Oct 4, 2026Shang Wang, Tianqing Zhu, Huajie Chen +3LLM Backdoor AttacksModel Extraction Attacks

  3. ToolFence: Fine-Grained Authorization for Secure Tool-Using LLM Agents

    Sep 29, 2026Yanjie Li, Xiangyu He, Xuelong Dai +1Runtime Enforcement for AI AgentsPrompt Injection Defense

  4. Divide and Inject: Can Agents Reconstruct an Indirect Prompt Injection from Fragments?

    Sep 29, 2026Michael Lee, Zhipeng Wei, Yue Dong +1Indirect Prompt InjectionPrompt Injection Attacks

  5. Same Bytes, Different Authority: Reserved-Token Representations in Chat-Template Prompt Injection

    Sep 28, 2026Yan Zhan, Yunze Song, Mengkai Hou +3Prompt InjectionPrompt Injection Defense

  6. ENDOPROMPT: Victim-Side Pseudo-References for Utility Degradation

    Sep 24, 2026Qingyu Wu, Zeyu Feng, Yongda Yu +2Adversarial Prompt GenerationPrompt Injection Attacks

  7. Prefilling the Reasoning Channel: Output-Prefix Attacks on Reasoning LLMs

    Sep 24, 2026Lukáš Brůna, Robert Bridges, Adam EkAdversarial Attacks on LLMsPrompt Injection Attacks

  8. Nameless Tokenization: A Lossless Tokenizer-Level Defense Against Control-Token Forgery in Open-Weight LLMs

    Sep 15, 2026Kisu Yang, Yoonna Jang, Heuiseok LimAdversarial Attacks on LLMsLLM Security

  9. AgentHijack: Visual Patch Attacks on Multimodal Computer-Use Agents

    Sep 10, 2026Zhihao Liu, Hongyu Sun, Zhiyuan Fu +7Adversarial Patch AttacksComputer-Use Agents

  10. An Experimental Evaluation of Multimodal Prompt Injection Attacks on Agentic AI Frameworks

    Sep 10, 2026Viet K. Nguyen, Mohammad I. HusainAI Agent SecurityAI Agent Security Benchmarks

  11. Beyond the Payload: How User Invocation Shapes Coding Agent Vulnerability to Repository Poisoning

    Aug 31, 2026Fukang Zhu, Binbin Zhao, Ruixiao Lin +3Prompt SensitivityAI Coding Agents

  12. AgentAntibody: An Adaptive Immune System for Defending LLM Agents against Prompt Injection

    Aug 4, 2026Shihao Weng, Yang Feng, Xiaofei Xie +1Continual Learning for LLM AgentsLLM Agent Security

  13. Invisible Ink Threats: Adversarial Goals Behind Legitimate Tasks in Computer-Use Agents

    Aug 3, 2026Jia-Chen Zhang, Ze-Yu Zhang, Kai-Wei ZhangAI Agent Security BenchmarksPrompt Injection Defense

  14. CPInj: Uncovering Prompt Injection Risks in Textual Collaborative Prompt Optimization

    Jul 21, 2026Xinting Liao, Behnoosh Zamanlooy, Masoumeh Shafieinejad +4LLM SecurityPrompt Injection Defense

  15. Bad Memory: Evaluating Prompt Injection Risks from Memory in Agentic Systems

    Jul 16, 2026Soham Gadgil, David Alexander, Sai Sunku +1AI Agent SecurityAgent Memory Poisoning

  16. Prismata: Confining Cross-Site Prompt Injection in Web Agents

    Jul 9, 2026Corban Villa, Alp Eren Ozdarendeli, Sijun Tan +1LLM Agent SecurityInformation Flow Control

  17. A Lifecycle and Application-Stack Survey of Large Language Model Vulnerabilities: Attacks, Risks, Defenses, and Open Problems

    Jun 30, 2026Seyed Bagher Hashemi Natanzi, Bo TangAI Agent SecurityLLM Security

  18. Prompt Injection in Automated Résumé Screening with Large Language Models: Single and Multi-Injection Settings

    Jun 25, 2026Preet Baxi, Jiannan Xu, Jane Yi Jiang +1Algorithmic FairnessPrompt Injection Attacks

  19. Adaptive Evaluation of Out-of-Band Defenses Against Prompt Injection in LLM Agents

    Jun 25, 2026Praneeth Narisetty, Shiva Nagendra Babu Kore, Uday Kumar Reddy Kattamanchi +1LLM Agent EvaluationLLM Agent Security

  20. Confidently Wrong: Severity-Aware Calibration of Prompt-Injection Detectors under Attack Shift

    Jun 21, 2026Md Anas BiswasIndirect Prompt InjectionModel Calibration

  21. SafeClawBench: Separating Semantic, Audit-Evidence, and Sandbox Harm in Tool-Using LLM Agents

    Jun 16, 2026Yuchuan Tian, Mengyu Zheng, Haocheng Mei +5LLM Safety BenchmarksLLM Agent Security

  22. Seeing Is Not Screening: Multimodal Hidden Instruction Attacks on Agent Skill Scanners

    Jun 16, 2026Xiaojun Jia, Jie Liao, Simeng Qin +5LLM Agent SecurityPrompt Injection Defense

  23. Rapid Poison: Practical Poisoning Attacks Against the Rapid Response Framework

    Jun 15, 2026David Huang, Jaewon Chang, Avidan Shah +2LLM Backdoor AttacksPrompt Injection Attacks