LLM Agent Security

LLM: Large Language Model

Latest papers 234

All topics
CardsList
  1. SEVRA-BENCH: Social Engineering of Vulnerabilities in Review Agents

    Jun 11, 2026Rui Melo, Riccardo Fogliato, Sean Zhou +2Software Vulnerability DetectionAI Agent Security

  2. Who Pays the Price? Stakeholder-Centric Prompt Injection Benchmarking for Real-world Web Agents

    Jun 11, 2026Zihao Wang, Yiming Li, Yutong Wu +8AI Agent EvaluationLLM Agent Security

  3. Smarter Saboteurs, Better Fixers: Scaling & Security in Linear Multi-Agent Workflows

    Jun 10, 2026Timothy McAllister, Sina Abdidizaji, Ivan Garibay +1AI Agent SecurityLLM Agent Security

  4. SAIGuard: Communication-State Simulation for Proactive Defense of LLM Multi-Agent Systems

    Jun 10, 2026Ruxue Shi, Yili Wang, Mengnan Du +4LLM Agent SecurityMulti-Agent System Security

  5. ABC-Bench: An Agentic Bio-Capabilities Benchmark for Biosecurity

    Jun 9, 2026Andrew Bo Liu, Samira Nedungadi, Bryce Cai +3LLM Agent SecurityAI Agent Security Benchmarks

  6. Understanding and mitigating the risks of OpenClaw for non-technical users: A practical guide with Skill

    Jun 9, 2026Junchang Zheng, Junfeng Tan, Jialiang LinCybersecurityAI Agent Security

  7. Toward Secure LLM Agents: Threat Surfaces, Attacks, Defenses, and Evaluation

    Jun 9, 2026Yuchen Ling, Shengcheng Yu, Zhenyu Chen +1Prompt InjectionLLM Agent Security

  8. Assessing Automated Prompt Injection Attacks in Agentic Environments

    Jun 9, 2026David Hofer, Edoardo Debenedetti, Florian TramèrAdversarial Prompt GenerationLLM Agent Security

  9. SafeGEO: Understanding Generative Engine Optimization Risks in Recommendation Agents

    Jun 8, 2026Qianfeng Wen, Yifan Simon Liu, Xin Liu +4Generative Engine OptimizationLLM Agent Security

  10. Context-Fractured Decomposition Attacks on Tool-Using LLM Agents: Exploiting Artifact Provenance Gaps

    Jun 8, 2026Xiaofeng Lin, Yukai Yang, Daniel Guo +3Jailbreak AttacksLLM Agent Security

  11. Data Agents Under Attack: Vulnerabilities in LLM-Driven Analytical Systems

    Jun 7, 2026Kuncan Wang, Ziting Wang, Peizhuo Lv +4LLM Agent EvaluationCybersecurity

  12. The Cold-Start Safety Gap in LLM Agents

    Jun 5, 2026Chung-En Sun, Linbo Liu, Tsui-Wei WengLLM Agent SecurityAI Agent Safety Benchmarks

  13. Hierarchical Certified Semantic Commitment for Byzantine-Resilient LLM-Agent Collaboration

    Jun 5, 2026Haoran Xu, Lei Zhang, Iadh Ounis +1Multi-Agent LLM SystemsLLM Agent Security

  14. Ghost Tool Calls: Issue-Time Privacy for Speculative Agent Tools

    Jun 1, 2026Bardia Mohammadi, Lars Klein, Akhil Arora +1Data LeakageLLM Agent Security

  15. SeClaw: Spec-Driven Security Task Synthesis for Evaluating Autonomous Agents

    Jun 1, 2026Hao Cheng, Changtao Miao, Tianle Song +21AI Agent EvaluationLLM Agent Security

  16. Defenses & Enablers For Skill Injection Attacks on Terminal Based Agents

    Jun 1, 2026Yoshinari Fujinuma, Varun Gangal, Traian Rebedea +4Adversarial Attacks on LLMsLLM Agent Security

  17. "I Strongly Suspect This Website Is a Scam": Benchmarking PII Leakage and Detection without Defense in Autonomous Web Agents

    May 30, 2026Soham Roy, Sarthakbrata Halder, Arya Bharaty +5Data LeakageLLM Agent Security

  18. When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems

    May 30, 2026Su Wang, Pin Qian, Yihang Chen +6Software SecurityAI Agent Security

  19. Stateful Online Monitoring Catches Distributed Agent Attacks

    May 29, 2026Davis Brown, Samarth Bhargav, Arav Santhanam +7LLM Agent SecurityAI Agent Monitoring

  20. From Prompt Injection to Persistent Control: Defending Agentic Harness Against Trojan Backdoors

    May 29, 2026Jiejun Tan, Zhicheng Dou, Xinyu Yang +4Prompt InjectionLLM Agent Security

  21. PrivacyPeek: Auditing What LLM-Based Agents Acquire, Not Just What They Say

    May 29, 2026Mingxuan Zhang, Jiahui Han, Dadi Guo +5Data LeakagePrivacy Auditing

  22. Automatically Attacking Software Reverse Engineering AI Agents

    May 28, 2026Brian Crawford, Justin Phillips, Patrick McClureSoftware EngineeringAdversarial Prompt Generation

  23. An Organization-Scoped LLM Agent Runtime Architecture for Regulated Cybersecurity Operations

    May 28, 2026George Fatouros, Georgios Makridis, George Kousiouris +2CybersecurityLLM Agent Security