LLM Security

LLM: Large Language Model

Latest papers 200

All topics
CardsList
  1. CARTS: Contextual Autoregressive Rank Transcoding Steganography for Full-Capacity Keyed Text Encoding

    Sep 12, 2026Wissam Ghantous, Alexander V. MantzarisLLM Security

  2. Capability-Gated Language Models: Security Composes, Utility Does Not

    Aug 31, 2026Patrikas Vanagas, Augustas Mačijauskas, Laurynas LopataLanguage Model Safety EvaluationLLM Security

  3. Hidden Threat in Synthetic Data: Covert Targeted Bias Injection through Benign Text

    Aug 31, 2026Minkyung Cho, Jihyo Kim, SeungWoo Song +4Social Bias in Language ModelsLLM Security

  4. Interpreting and Steering for Safe and Correct Code Generation

    Aug 30, 2026Hao Yan, Ziyu YaoMechanistic InterpretabilityLLM Security

  5. Backdoor Decontamination Dynamics in LLM Agents

    Aug 11, 2026Gabriel Huang, Abhay Puri, Léo Boisvert +4LLM Backdoor AttacksBackdoor Defense in LLMs

  6. On Understanding, Identifying, and Mitigating Vulnerabilities in Agentic Large Language Models

    Aug 11, 2026Md Jafrin Hossain, Mohammad Arif Hossain, Nirwan AnsariLLM Agent SecurityLLM Security

  7. Stealing Reasoning Traces from Proprietary LLM APIs

    Aug 10, 2026Alexander Panfilov, David Schmotz, Ilia Shumailov +5Model Extraction AttacksAdversarial Attacks

  8. Dual-Adversarial Safety Alignment: Cultivating Intrinsic Threat Comprehension in LRMs

    Aug 10, 2026Hongli Shen, Shaopeng Fu, Qinbo Zhang +2Adversarial TrainingAdversarial Attacks on LLMs

  9. Taxonomy-Driven Analysis of Open-Source AI Risk Mitigation Tools

    Aug 7, 2026Afreen Alam, Evgenija Popchanovska, Ana Gjorgjevikj +4AI Risk ManagementLLM Security

  10. LoRAScan: Detecting Backdoor Prompts in Low-Rank Adapters for Large Language Models via Down-Projection Activation Spikes

    Aug 7, 2026Doniyorkhon Obidov, Honggang Yu, Xiaolong Guo +1LLM Backdoor AttacksBackdoor Detection

  11. Hardware Design and Security in the Era of Chiplets and LLMs

    Aug 5, 2026Johann Knechtel, Ozgur Sinanoglu, Paul V. Gratz +1Electronic Design AutomationCybersecurity

  12. Gradient Immunity: Null-Space Resistance to Malicious Fine-Tuning

    Aug 5, 2026Yuxuan Huang, Xingyu Zeng, Tianhang Zheng +1LLM Safety AlignmentLLM Security

  13. An Inline Control Architecture for Language Models in Intelligent Transportation Systems

    Aug 4, 2026Narendra Kumar Dewangan, Mounira MsahliLLM GuardrailsAdversarial Attacks on LLMs

  14. A Security-Oriented Lifecycle Model for Large Language Model Systems

    Aug 4, 2026Eleftherios Batzolis, George Drosatos, Vassilis Katsouros +1AI AssuranceLLM Security

  15. SparSEEty: Extracting Tokens from Sparsity-Exploiting LLM Serving Systems via Deterministic Side Channels

    Aug 4, 2026Yongwan Jo, Jinyoung Park, Euihyun Lee +1Privacy Leakage in Language ModelsLLM Security

  16. LaCache: Robust Semantic Caching for LLM Serving

    Aug 3, 2026Jiacheng Liang, Yuhui Wang, Tanqiu Jiang +1LLM ServingLLM Security

  17. Decision-Level Hijacking: Injecting Cognitive Bias into Large Language Models via Bit-Flip Attacks

    Jul 28, 2026Yu Yan, Jiahao Chen, Siqi Lu +6LLM AlignmentAdversarial Attacks on LLMs