LLM Agent Security

LLM: Large Language Model

Latest papers 234

All topics
CardsList
  1. Benign in Isolation, Harmful in Composition: Security Risks in Agent Skill Ecosystems

    Jun 13, 2026Yi Xie, Jiawei Du, Yu Cheng +2LLM Agent SecurityAI Agent Security Benchmarks

  2. Securing Multi-Agent GIS Systems: Risk Evaluation and Prompt Hardening Optimization

    Jun 13, 2026Kyle Gao, Pranavi Kotta, Linlin Xu +2Adversarial RobustnessLLM Red Teaming

  3. SEVRA-BENCH: Social Engineering of Vulnerabilities in Review Agents

    Jun 11, 2026Rui Melo, Riccardo Fogliato, Sean Zhou +2Software Vulnerability DetectionAI Agent Security

  4. Who Pays the Price? Stakeholder-Centric Prompt Injection Benchmarking for Real-world Web Agents

    Jun 11, 2026Zihao Wang, Yiming Li, Yutong Wu +8AI Agent EvaluationLLM Agent Security

  5. Smarter Saboteurs, Better Fixers: Scaling & Security in Linear Multi-Agent Workflows

    Jun 10, 2026Timothy McAllister, Sina Abdidizaji, Ivan Garibay +1AI Agent SecurityLLM Agent Security

  6. SAIGuard: Communication-State Simulation for Proactive Defense of LLM Multi-Agent Systems

    Jun 10, 2026Ruxue Shi, Yili Wang, Mengnan Du +4LLM Agent SecurityMulti-Agent System Security

  7. ABC-Bench: An Agentic Bio-Capabilities Benchmark for Biosecurity

    Jun 9, 2026Andrew Bo Liu, Samira Nedungadi, Bryce Cai +3LLM Agent SecurityAI Agent Security Benchmarks

  8. Understanding and mitigating the risks of OpenClaw for non-technical users: A practical guide with Skill

    Jun 9, 2026Junchang Zheng, Junfeng Tan, Jialiang LinCybersecurityAI Agent Security

  9. Toward Secure LLM Agents: Threat Surfaces, Attacks, Defenses, and Evaluation

    Jun 9, 2026Yuchen Ling, Shengcheng Yu, Zhenyu Chen +1Prompt InjectionLLM Agent Security

  10. Assessing Automated Prompt Injection Attacks in Agentic Environments

    Jun 9, 2026David Hofer, Edoardo Debenedetti, Florian TramèrAdversarial Prompt GenerationLLM Agent Security

  11. SafeGEO: Understanding Generative Engine Optimization Risks in Recommendation Agents

    Jun 8, 2026Qianfeng Wen, Yifan Simon Liu, Xin Liu +4Generative Engine OptimizationLLM Agent Security

  12. Context-Fractured Decomposition Attacks on Tool-Using LLM Agents: Exploiting Artifact Provenance Gaps

    Jun 8, 2026Xiaofeng Lin, Yukai Yang, Daniel Guo +3Jailbreak AttacksLLM Agent Security

  13. Data Agents Under Attack: Vulnerabilities in LLM-Driven Analytical Systems

    Jun 7, 2026Kuncan Wang, Ziting Wang, Peizhuo Lv +4LLM Agent EvaluationCybersecurity

  14. The Cold-Start Safety Gap in LLM Agents

    Jun 5, 2026Chung-En Sun, Linbo Liu, Tsui-Wei WengLLM Agent SecurityAI Agent Safety Benchmarks

  15. Hierarchical Certified Semantic Commitment for Byzantine-Resilient LLM-Agent Collaboration

    Jun 5, 2026Haoran Xu, Lei Zhang, Iadh Ounis +1Multi-Agent LLM SystemsLLM Agent Security

  16. Ghost Tool Calls: Issue-Time Privacy for Speculative Agent Tools

    Jun 1, 2026Bardia Mohammadi, Lars Klein, Akhil Arora +1Data LeakageLLM Agent Security

  17. SeClaw: Spec-Driven Security Task Synthesis for Evaluating Autonomous Agents

    Jun 1, 2026Hao Cheng, Changtao Miao, Tianle Song +21AI Agent EvaluationLLM Agent Security

  18. Defenses & Enablers For Skill Injection Attacks on Terminal Based Agents

    Jun 1, 2026Yoshinari Fujinuma, Varun Gangal, Traian Rebedea +4Adversarial Attacks on LLMsLLM Agent Security

  19. "I Strongly Suspect This Website Is a Scam": Benchmarking PII Leakage and Detection without Defense in Autonomous Web Agents

    May 30, 2026Soham Roy, Sarthakbrata Halder, Arya Bharaty +5Data LeakageLLM Agent Security

  20. When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems

    May 30, 2026Su Wang, Pin Qian, Yihang Chen +6Software SecurityAI Agent Security

  21. Stateful Online Monitoring Catches Distributed Agent Attacks

    May 29, 2026Davis Brown, Samarth Bhargav, Arav Santhanam +7LLM Agent SecurityAI Agent Monitoring

  22. From Prompt Injection to Persistent Control: Defending Agentic Harness Against Trojan Backdoors

    May 29, 2026Jiejun Tan, Zhicheng Dou, Xinyu Yang +4Prompt InjectionLLM Agent Security