LLM Agent Security

LLM: Large Language Model

Latest papers 234

All topics
CardsList
  1. Distributing Security Controls Through Harness Engineering

    Jul 28, 2026William Robert GoreAI Agent SecurityLLM Agent Security

  2. Agent Skills Matter: Inferring Proprietary Skills from Execution Trajectories

    Jul 28, 2026Jianing Geng, Ruiqi He, Zekun Fei +6LLM Agent Security

  3. Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response

    Jul 28, 2026Abu Bakar SiddikAI Agent EvaluationCybersecurity

  4. Explanation-Bound Tool Execution for AI Agents: Server-Verified Action Claims Without Trusting Model Rationales

    Jul 28, 2026Genliang Zhu, Chu WangLLM Agent SecurityLLM Agent Verification

  5. Hybrid Analysis for Secure MCP Tool Use in LLM Agents

    Jul 28, 2026Ping He, Yuexiang Xie, Yaliang Li +1MCP SecurityLLM Agent Security

  6. Agentic Permissions Policy Algebra for Taint Confinement in LLM Agents

    Jul 27, 2026Arseny Kravchenko, Vadim Liventsev, Innokentii Konstantinov +2LLM Agent SecurityPrompt Injection Attacks on AI Agents

  7. Agentic Cloud Decoys: A Deception-Driven Framework for Autonomous Intrusion Investigation

    Jul 27, 2026Mohan Manivannan, Dalal AlharthiAutonomous Cyber DefenseCybersecurity

  8. ToolGuardian: Declarative Security for AI Agent-Tool Interactions

    Jul 23, 2026Arun Ravindran, Saurabh DeochakeAI Agent SecurityLLM Agent Security

  9. Twin Agent: Context Residual Compression for Privilege Separated Agents

    Jul 21, 2026Zhanhao Hu, Dennis Jacob, Xiao Huang +3AI Agent SecurityLLM Agent Security

  10. Data Leakage Prevention in Agentic Applications via Preemptive Hardening

    Jul 21, 2026Akansha Shukla, Emily Bellov, Parth Atulbhai Gandhi +2AI Agent SecurityLLM Agent Security

  11. Broken Gates: Re-evaluating Web Bot Defenses in the Age of LLM Agents

    Jul 21, 2026Behzad Ousat, Nikita Turkmen, Lalchandra Rampersaud +2LLM Agent SecurityWeb Agents

  12. ChannelGuard: Safe Models Do Not Compose into Safe Multi-Agent Systems

    Jul 20, 2026Elias Hossain, Md Mehedi Hasan Nipu, Fatema Tuj Johora Faria +2LLM Agent SecurityPrompt Injection Attacks on AI Agents

  13. SlotGuard: Stop Oversharing Private Local Context in LLM Agent Transcri

    Jul 19, 2026Haocheng Xia, Yongjoo ParkLLM Agent SecurityPrivacy Leakage in Language Models

  14. MemPoison: Uncovering Persistent Memory Threats and Structural Blind Spots in LLM Agents

    Jul 16, 2026Jifeng Gao, Kang Xia, Yi Zhang +5LLM Agent MemoryLLM Agent Security

  15. Agent Hacks Agent: Autoresearch for Production-Agent Red-Teaming

    Jul 13, 2026Xutao Mao, Xiang Zheng, Cong WangLLM Agent SecurityAutomated Red Teaming

  16. VEXAIoT: Autonomous IoT Vulnerability EXploitation using AI Agents

    Jul 10, 2026Katherine Swinea, Kshitiz Aryal, Lopamudra Praharaj +1CybersecurityLLM Agent Security

  17. TRACE: A Two-Channel Robust Attribution Watermark via Complementary Embeddings for LLM-Agent Trajectories

    Jul 9, 2026Zheng Gao, Xiaoyu Li, Xiaoyan Feng +5LLM Agent SecurityLLM Watermarking

  18. Prismata: Confining Cross-Site Prompt Injection in Web Agents

    Jul 9, 2026Corban Villa, Alp Eren Ozdarendeli, Sijun Tan +1LLM Agent SecurityInformation Flow Control

  19. When Agents Go Rogue: Activation-Based Detection of Malicious Behaviors in Multi-Agent Systems

    Jul 7, 2026Haowen Xu, Xue Tan, Lei Ma +6LLM Agent SecurityAI Agent Monitoring

  20. When Agents Remember Too Much: Memory Poisoning Attacks on Large Language Model Agents

    Jul 6, 2026George Torres, Sharad Shrestha, Satyajayant MisraAI Agent SecurityLLM Agent Security

  21. aiAuthZ: Off-Host, Identity-Bound Authorization for AI Agents

    Jul 6, 2026Sai Varun KodathalaAI Agent SecurityLLM Agent Security

  22. DualView: Preventing Indirect Prompt Injection in Personal AI Agents

    Jul 4, 2026Juhee Kim, Woohyuk Choi, Taehyun Kang +2LLM Agent SecurityIndirect Prompt Injection