LLM Security

LLM: Large Language Model

Latest papers 200

All topics
CardsList
  1. Continuous Discovery of Vulnerabilities in LLM Serving Systems with Fuzzing

    May 11, 2026Yunze Zhao, Yibo Zhao, Yuchen Zhang +2LLM ServingLLM Security

  2. LLMs for Secure Hardware Design and Related Problems: Opportunities and Challenges

    May 11, 2026Johann Knechtel, Ozgur Sinanoglu, Ramesh KarriElectronic Design AutomationCybersecurity

  3. Locking Pretrained Weights via Deep Low-Rank Residual Distillation

    May 11, 2026Keitaro Sakamoto, Pierre Ablin, Federico Danieli +1Open-Weight Language ModelsLLM Security

  4. When Prompts Become Payloads: A Framework for Mitigating SQL Injection Attacks in Large Language Model-Driven Applications

    May 11, 2026Farzad Nourmohammadzadeh Motlagh, Mehrdad Hajizadeh, Mehryar Majd +3LLM SecurityText-to-SQL

  5. Benchmarking Safety Risks of Knowledge-Intensive Reasoning under Malicious Knowledge Editing

    May 11, 2026Qinghua Mao, Xi Lin, Jinze Gu +3Knowledge EditingKnowledge Conflicts in Language Models

  6. OTora: A Unified Red Teaming Framework for Reasoning-Level Denial-of-Service in LLM Agents

    May 9, 2026Xinyu Li, Ronghui Mu, Lin Li +2Adversarial Attacks on LLMsLLM Red Teaming

  7. Graph Representation Learning Augmented Model Manipulation on Federated Fine-Tuning of LLMs

    May 8, 2026Hanlin Cai, Kai Li, Houtianfu Wang +4LLM Fine-TuningLLM Security

  8. Seed Hijacking of LLM Sampling and Quantum Random Number Defense

    May 8, 2026Ziyang You, Xiaoke Yang, Zhanling Fan +3LLM Backdoor AttacksLLM Security

  9. Correct Code, Vulnerable Dependencies: A Large Scale Measurement Study of LLM-Specified Library Versions

    May 7, 2026Chengjie Wang, Jingzheng Wu, Xiang Ling +2Software EngineeringLLM Security

  10. SoK: Robustness in Large Language Models against Jailbreak Attacks

    May 6, 2026Feiyue Xu, Hongsheng Hu, Chaoxiang He +9Language Model Safety EvaluationLLM Security

  11. On the (In-)Security of the Shuffling Defense in the Transformer Secure Inference

    May 6, 2026Zhengyi Li, Yakai Wang, Kang Yang +6Transformer InferenceModel Extraction Attacks

  12. TwinGate: Stateful Defense against Decompositional Jailbreaks in Untraceable Traffic via Asymmetric Contrastive Learning

    Apr 30, 2026Bowen Sun, Chaozhuo Li, Yaodong Yang +2Jailbreak AttacksLLM Security

  13. From Prompt to Physical Actuation: Holistic Threat Modeling of LLM-Enabled Robotic Systems

    Apr 29, 2026Neha Nagaraja, Hayretdin Bahsi, Carlo R. da CunhaLarge Language Model-Based Robot PlanningCybersecurity

  14. DSIPA: Detecting LLM-Generated Texts via Sentiment-Invariant Patterns Divergence Analysis

    Apr 29, 2026Siyuan Li, Aodu Wulianghai, Guangyan Li +5AI-Generated Text DetectionLLM Security

  15. Cross-Lingual Jailbreak Detection via Semantic Codebooks

    Apr 28, 2026Shirin Alanova, Bogdan Minko, Sabrina Sadiekh +1Multilingual Language Model EvaluationLLM Security

  16. Defusing the Trigger: Plug-and-Play Defense for Backdoored LLMs via Tail-Risk Intrinsic Geometric Smoothing

    Apr 27, 2026Kaisheng Fan, Weizhe Zhang, Yishu Gao +2LLM Backdoor AttacksBackdoor Defense in LLMs

  17. Evaluation of Prompt Injection Defenses in Large Language Models

    Apr 26, 2026Priyal Deep, Shane Emmons, Amy Fox +4Data LeakagePrivacy Leakage in Language Models

  18. Semantic Denial of Service in LLM-controlled robots

    Apr 25, 2026Jonathan Steinberg, Oren GalLanguage Model Safety EvaluationAdversarial Attacks on LLMs

  19. Stealthy Backdoor Attacks against LLMs Based on Natural Style Triggers

    Apr 23, 2026Jiali Wei, Ming Fan, Guoheng Sun +3LLM Backdoor AttacksBackdoor Attacks

  20. AVISE: Framework for Evaluating the Security of AI Systems

    Apr 22, 2026Mikko Lempinen, Joni Kemppainen, Niklas RaesalmiLanguage Model Safety EvaluationAdversarial Attacks on LLMs

  21. Text Steganography with Dynamic Codebook and Multimodal Large Language Model

    Apr 22, 2026Jianxin Gao, Ruohan Lei, Wanli PengLLM Security

  22. Omission Constraints Decay While Commission Constraints Persist in Long-Context LLM Agents

    Apr 22, 2026Yeran GamageAI Agent MonitoringLLM Security

  23. An Empirical Study of Multi-Generation Sampling for Jailbreak Detection in Large Language Models

    Apr 20, 2026Hanrui Luo, Shreyank N GowdaLanguage Model Safety EvaluationLLM Auditing

  24. Understanding Secret Leakage Risks in Code LLMs: A Tokenization Perspective

    Apr 20, 2026Meifang Chen, Zhe Yang, Huang Nianchen +4Data LeakageMemorization in Language Models