LLM Agent Security

LLM: Large Language Model

Latest papers 234

All topics
CardsList
  1. CI-Work: Benchmarking Contextual Integrity in Enterprise LLM Agents

    Apr 23, 2026Wenjie Fu, Xiaoting Qin, Jue Zhang +5Data LeakageContextual Integrity

  2. FSFM: A Biologically-Inspired Framework for Selective Forgetting of Agent Memory

    Apr 22, 2026Yingjie Gu, Wenjian Xiong, Liqiang Wang +7LLM Agent SecurityMemory-Augmented Agents

  3. SafeAgent: A Runtime Protection Architecture for Agentic Systems

    Apr 19, 2026Hailin Liu, Eugene Ilyushin, Jie Ni +1Adversarial Attacks on LLMsAI Agent Security

  4. CapSeal: Capability-Sealed Secret Mediation for Secure Agent Execution

    Apr 18, 2026Shutong Jin, Ruiyi Guo, Ray C. C. CheungAI Agent SecurityLLM Agent Security

  5. HarmfulSkillBench: How Do Harmful Skills Weaponize Your Agents?

    Apr 16, 2026Yukun Jiang, Yage Zhang, Michael Backes +2LLM Agent SecurityAI Agent Security Benchmarks

  6. Dive into Claude Code: The Design Space of Today's and Future AI Agent Systems

    Apr 14, 2026Jiacheng Liu, Xiaohan Zhao, Xinyi Shang +1AI Coding AgentsLLM Agent Orchestration

  7. T-MAP: Red-Teaming LLM Agents with Trajectory-aware Evolutionary Search

    Mar 21, 2026Hyomin Lee, Sangwoo Park, Yumin Choi +3Adversarial Prompt GenerationLLM Red Teaming

  8. AgentWorm: Self-Propagating Attacks Across LLM Agent Ecosystems

    Mar 16, 2026Yihao Zhang, Zeming Wei, Xiaokun Luan +7LLM Agent SecurityMulti-Agent System Security

  9. Quantifying Frontier LLM Capabilities for Container Sandbox Escape

    Mar 1, 2026Rahul Marchand, Art O Cathain, Jerome Wynne +5LLM Safety BenchmarksLLM Agent Security

  10. From Similarity to Vulnerability: Key Collision Attack on LLM Semantic Caching

    Jan 30, 2026Zhixiang Zhang, Zesen Liu, Yuchong Xie +2Adversarial AttacksLLM Agent Security

  11. Just Ask: Curious Code Agents Reveal System Prompts in Frontier LLMs

    Jan 29, 2026Xiang Zheng, Yutao Wu, Hanxun Huang +5Prompt InjectionAI Coding Agents

  12. AgenTRIM: Tool Risk Mitigation for Agentic AI

    Jan 18, 2026Roy Betser, Amit Giloni, Shamik Bose +4LLM Agent SecurityIndirect Prompt Injection

  13. Agent Tools Orchestration Leaks More: Dataset, Benchmark, and Mitigation

    Dec 18, 2025Yuxuan Qiao, Dongqin Liu, Hongchang Yang +2LLM Agent SecurityLLM Agents

  14. MAS-Shield: A Defense Framework for Secure and Efficient LLM MAS

    Nov 28, 2025Kaixiang Wang, Zhaojiacheng Zhou, Bunyod Suvonov +8Multi-Agent LLM SystemsLLM Auditing

  15. Breaking the Code: Security Assessment of AI Code Agents Through Systematic Jailbreaking Attacks

    Oct 1, 2025Shoumik Saha, Jifan Chen, Sam Mayers +3AI Coding AgentsAI Agent Security

  16. Red-Teaming Coding Agents from a Tool-Invocation Perspective: An Empirical Security Assessment

    Sep 6, 2025Yuchong Xie, Mingyu Luo, Zesen Liu +7Prompt InjectionAI Coding Agents

  17. Meta-SecAlign: Training LLMs against Prompt Injection for Robust Agents

    Jul 3, 2025Sizhe Chen, Arman Zharmagambetov, David Wagner +1LLM Agent SecurityAI Agent Security Benchmarks

  18. Seven Security Challenges in Cross-domain Multi-agent LLM Systems

    May 28, 2025Ronny Ko, Jiseong Jeong, Shuyuan Zheng +4Multi-Agent LLM SystemsLLM Agent Security

  19. BodhiPromptShield: Pre-Inference Prompt Mediation for Surface-Form Privacy Propagation in LLM Agent Pipelines

    Date pendingBo Ma, Jinsong Wu, Weiqi YanData LeakagePrivacy-Preserving Language Models