LLM Agent Security

LLM: Large Language Model

Latest papers 234

All topics
CardsList
  1. PRISM: Generation-Time Detection and Mitigation of Secret Leakage in Multi-Agent LLM Pipelines

    May 11, 2026Riya Tapwal, Abhishek Kumar, Carsten MapleData LeakageMulti-Agent LLM Systems

  2. Red-Teaming Agent Execution Contexts: Open-World Security Evaluation on OpenClaw

    May 11, 2026Hongwei Yao, Yiming Liu, Yiling He +1AI Agent SecurityLLM Agent Security

  3. The Granularity Mismatch in Agent Security: Argument-Level Provenance Solves Enforcement and Isolates the LLM Reasoning Bottleneck

    May 11, 2026Linfeng Fan, Ziwei Li, Yuan Tian +3LLM Agent SecurityInformation Flow Control

  4. Oracle Poisoning: Corrupting Knowledge Graphs to Weaponise AI Agent Reasoning

    May 10, 2026Ben Kereopa-Yorke, Guillermo Diaz, Holly Wright +3AI Agent SecurityLLM Agent Security

  5. AgentShield: Deception-based Compromise Detection for Tool-using LLM Agents

    May 10, 2026Yassin H. Rassul, Tarik A. RashidLLM Agent SecurityAI Agent Monitoring

  6. FORTIS: Benchmarking Over-Privilege in Agent Skills

    May 9, 2026Shawn Li, Chenxiao Yu, Han Wang +8LLM Agent SecurityAI Agent Security Benchmarks

  7. When Child Inherits: Modeling and Exploiting Subagent Spawn in Multi-Agent Networks

    May 8, 2026Ziwen Cai, Yihe Zhang, Xiali HeiLLM Agent SecurityMulti-Agent System Security

  8. PropGuard: Safeguarding LLM-MAS via Propagation-Aware Exploration and Remediation

    May 8, 2026Bingyu Yan, Xiaoming Zhang, Jinyu Hou +4LLM Agent SecurityPrompt Injection Attacks on AI Agents

  9. Towards Security-Auditable LLM Agents: A Unified Graph Representation

    May 7, 2026Chaofan Li, Lyuye Zhang, Jintao Zhai +9LLM Agent SecurityMulti-Agent System Security

  10. When Routine Chats Turn Toxic: Unintended Long-Term State Poisoning in Personalized Agents

    May 7, 2026Xiaoyu Xu, Minxin Du, Qipeng Xie +3LLM Agent SecurityAgent Memory Poisoning

  11. PragLocker: Protecting Agent Intellectual Property in Untrusted Deployments via Non-Portable Prompts

    May 7, 2026Qinfeng Li, Yuntai Bao, Jianghui Hu +5LLM Agent Security

  12. LoopTrap: Termination Poisoning Attacks on LLM Agents

    May 7, 2026Huiyu Xu, Zhibo Wang, Wenhui Zhang +4Adversarial Attacks on LLMsLLM Red Teaming

  13. SafeHarbor: Hierarchical Memory-Augmented Guardrail for LLM Agent Safety

    May 7, 2026Zhe Liu, Zonghao Ying, Wenxin Zhang +5LLM GuardrailsLLM Agent Security

  14. Agentic Vulnerability Reasoning on COTS Binaries

    May 6, 2026Hwiwon Lee, Jongseong Kim, Lingming ZhangSoftware Reverse EngineeringSoftware Vulnerability Detection

  15. Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory

    May 4, 2026Yuhui Wang, Tanqiu Jiang, Jiacheng Liang +2LLM Agent SecurityAgent Memory Management

  16. When Agents Handle Secrets: A Survey of Confidential Computing for Agentic AI

    May 4, 2026Javad Forough, Marios Kogias, Hamed HaddadiCybersecurityRemote Attestation

  17. Hybrid Inspection and Task-Based Access Control in Zero-Trust Agentic AI

    May 4, 2026Majed El Helou, Benjamin Ryder, Chiara Troiani +3CybersecurityLLM Agent Security

  18. When Alignment Isn't Enough: Response-Path Attacks on LLM Agents

    May 4, 2026Mingyu Luo, Zihan Zhang, Zesen Liu +7AI Agent ReliabilityLLM Agent Security

  19. A Low-Latency Fraud Detection Layer for Detecting Adversarial Interaction Patterns in LLM-Powered Agents

    May 1, 2026Sheldon Yu, Yingcheng Sun, Hanqing Guo +1AI Agent SecurityLLM Agent Security

  20. Semia: Auditing Agent Skills via Constraint-Guided Representation Synthesis

    May 1, 2026Hongbo Wen, Ying Li, Hanzhi Liu +4AI Agent AuditingStatic Code Analysis

  21. Security Attack and Defense Strategies for Autonomous Agent Frameworks: A Layered Review with OpenClaw as a Case Study

    Apr 30, 2026Luyao Xu, Xiang ChenAI Agent SecurityLLM Agent Security

  22. SUDP: Secret-Use Delegation Protocol for Agentic Systems

    Apr 27, 2026Xiaohang Yu, Hejia Geng, Xinmeng Zeng +1CybersecurityLLM Agent Security

  23. RouteGuard: Internal-Signal Detection of Skill Poisoning in LLM Agents

    Apr 24, 2026Wenjie Xiao, Xuehai Tang, Biyu Zhou +2LLM Agent SecurityPrompt Injection Attacks on LLMs