LLM Agent Security

LLM: Large Language Model

Latest papers 234

All topics
CardsList
  1. ResidualAuth: What Authorization State Must Language Agents Preserve under Revocable Delegation?

    Sep 8, 2026Moonwon Choi, Seokho Jeong, Sian Choi +1LLM Agent SecurityAccess Control

  2. Staying on the Attack Path: Structured State for Long-Horizon Automated Penetration Testing

    Sep 7, 2026Weizhe Wang, Yitong Zhang, Yao Zhang +4LLM Agent MemoryLLM Agent Security

  3. AgentLeak: Cloning Stronger LLM Agent Capabilities onto Weaker Agents Beyond Skill Stealing

    Sep 7, 2026Xiaoting Lyu, Yuhong Wu, Yufei Han +6LLM Agent SecurityLLM Agent Skill Learning

  4. SENTINEL-RL: Offloading Topological Reasoning from LLM Agents in the Security Operations Center

    Sep 3, 2026Uday Vallabhaneni, Cassie L. Cagwin, David J. WildReinforcement LearningCybersecurity

  5. Agent Memory Is a Surface for Endogenous Authorization Laundering

    Sep 1, 2026Tommaso Cerruti, Mika Okamoto, Ansel Kaplan ErolLLM Agent MemoryLLM Agent Security

  6. Reachability-Based Capability Confinement for LLM Agents under Indirect Prompt Injection

    Aug 30, 2026Wujie Xiong, Rabimba Karanjai, Yang Lu +2LLM Agent SecurityInformation Flow Control

  7. Influence Is Not Authority: When Causal Guardrail Signals Make Legitimate Tool Use Look Like an Attack in Tool-Using LLM Agents

    Aug 30, 2026Tanzim Ahad, Ismail Hossain, Md Jahangir Alam +3LLM GuardrailsLLM Agent Security

  8. Beyond Handcrafted Security: Towards Self-Evolving Defense for LLM Agents

    Aug 13, 2026Jiajun Ruan, Peiyang Li, Yukun Chen +2LLM Agent SecurityLLM Agent Safety

  9. Labels Are Not Endpoints: Treatment Leakage and Construct Validity in MCP Agent Security Evaluation

    Aug 13, 2026Rana Muhammad Ahmed, Sabahat AbbasMCP SecurityLLM Agent Security

  10. Convergent Detour Hijacking: Task-Preserving Resource Amplification in Skill-Based LLM Agents

    Aug 12, 2026Junliang Liu, Ruoyu Li, Wenxin Tang +4Adversarial Attacks on LLMsLLM Agent Security

  11. Backdoor Decontamination Dynamics in LLM Agents

    Aug 11, 2026Gabriel Huang, Abhay Puri, Léo Boisvert +4LLM Backdoor AttacksBackdoor Defense in LLMs

  12. On Understanding, Identifying, and Mitigating Vulnerabilities in Agentic Large Language Models

    Aug 11, 2026Md Jafrin Hossain, Mohammad Arif Hossain, Nirwan AnsariLLM Agent SecurityLLM Security

  13. ColluSkill: Adversarial Cross-Skill Composition for Evading Agent Skill Scanners

    Aug 10, 2026Puyu Zeng, Simeng Qin, Jingzhi Li +3AI Agent SecurityLLM Agent Security

  14. ElasticBack: Stealthy Conditional Backdoor in LLM-Agent Skills via Coupled Trigger-Rule Optimization

    Aug 10, 2026Hao Sui, Simeng Qin, Jie Liao +3LLM Backdoor AttacksLLM Agent Security

  15. Not an A11y: How Android Accessibility Exposes Mobile AI Agents to Indirect Prompt Injection

    Aug 9, 2026Rahul Deivasigamani, Sayeda Faatin Alvi, Derqui Andrea +2AI Agent SecurityLLM Agent Security

  16. Persistent Semantic Entities in Tool-Augmented LLM Systems

    Aug 8, 2026Zhaohui WangAgent MemoryTool-Augmented Language Model Agents

  17. Hardware Keystores for AI Agent Signing Workflows: A Zero-Trust MCP Enforcement Architecture

    Aug 6, 2026Leo Sambrook, Sampo SovioMCP SecurityAI Agent Security

  18. Behavioral Skill Reconstruction: Reconstructing Hidden Functionality from LLM Agent Skills

    Aug 4, 2026Peichun Hua, Haoxuan Xu, Mengyuan LiLLM Agent Security

  19. AgentAntibody: An Adaptive Immune System for Defending LLM Agents against Prompt Injection

    Aug 4, 2026Shihao Weng, Yang Feng, Xiaofei Xie +1Continual Learning for LLM AgentsLLM Agent Security

  20. MNC: Scope-Bound Semantic Declassification for Private LLM-Agent Communication

    Aug 3, 2026Jinghan Xu, Longze Fan, Zeyuan Wang +2Multi-Agent LLM SystemsLLM Agent Security

  21. Beyond Single-Use Tokens: Durable Authorization State for Replay-Resistant LLM Agent Actions

    Aug 3, 2026Jinghan Xu, Longze Fan, Zeyuan Wang +2LLM Agent SecurityAccess Control

  22. Securing Agentic AI: From Per-Action Checks to Trajectory Assurance

    Aug 3, 2026Alireza Lotfi, Subangkar Karmaker Shanto, Imtiaz Karim +1AI Agent SecurityLLM Agent Security

  23. CAGE: Certified Authorization under Typed-Return Uncertainty for Tool-Using Agents

    Jul 31, 2026Blaise Delattre, Cong Wang, Yang CaoLLM Agent SecurityTool-Using Agents