Backdoor Defense

Momentum

4 papers in the last four weeks, up 33% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 37

All topics
CardsList
  1. Backdoor Containment via Expert Quarantine and Shutdown in LLMs

    Sep 30, 2026Jianwei Li, Min-Seon Kim, Jung-Eun KimLLM Backdoor AttacksBackdoor Defense in LLMs

  2. Selective Channel Restoration for Backdoored Vision-Language Models

    Sep 29, 2026Shuming Liu, Zhifang Zhang, Suqin Yuan +3VLM RobustnessLarge Vision-Language Models

  3. Backdoor as Probe: Test-Time Adversarial Defense for CLIP

    Sep 28, 2026Zhongqi Wang, Jie Zhang, Nie Sen +3VLM RobustnessBackdoor Defense

  4. ODPure: Backdoor Purification for Object Detection via Ensemble Corruption Consensus

    Sep 23, 2026Li Zeng, Mingcheng Duan, Longfei Fan +5Backdoor AttacksBackdoor Defense

  5. Beyond Small Patches: Black-Box Detection and Purification of Diverse Backdoor Triggers

    Sep 2, 2026Ahmed Abdelnaby, Mohamed ElmahallawyBackdoor DetectionBackdoor Defense

  6. Backdoor Decontamination Dynamics in LLM Agents

    Aug 11, 2026Gabriel Huang, Abhay Puri, Léo Boisvert +4LLM Backdoor AttacksBackdoor Defense in LLMs

  7. DiffSafeMerge: Mitigating Backdoor Inheritance in Diffusion Model Merging

    Aug 10, 2026Jiayang Zhang, Ji Guo, Jiachen Li +2Backdoor AttacksBackdoor Defense

  8. Mitigating Backdoors via Decoy Shortcuts and Knowledge Decoupling

    Aug 1, 2026Zixuan Zhu, Rui Wang, Lihua Jing +1Backdoor AttacksBackdoor Defense

  9. Anti-Backdoor Coreset Selection via Cumulative Entropy

    Jul 28, 2026Qi Zhao, Christian WressneggerNeural Network RobustnessTraining Data Selection

  10. SpeechGuard: Online Defense against Backdoor Attacks on Speech Recognition Models

    Jul 17, 2026Jinwen Xin, Xixiang LvBackdoor DetectionAutomatic Speech Recognition

  11. ORAN-DEFEND: Subspace Detection and Sanitization of Backdoor DRL xApps in Open RAN

    Jul 7, 2026Md Raihan Uddin, Fatemeh Lotfi, Tolunay Seyfi +1Adversarial AttacksBackdoor Detection

  12. The Power of Backdoor Absorption in Community Training

    Jul 7, 2026Issam Seddik, Sami Souihi, Mohamed Tamaazousti +1Algorithmic AuditingBackdoor Attacks

  13. Two Sides of the Same Coin: Learning the Backdoor to Remove the Backdoor

    Jul 7, 2026Qi Zhao, Christian WressneggerBackdoor AttacksBackdoor Detection

  14. Wireless Backdoor Attack and Defense for Semantic Communications over Multiple Access Channel

    Jun 29, 2026Yalin E. Sagduyu, Tugba Erpek, Aylin Yener +1Backdoor AttacksSemantic Communication

  15. Clustering Unsupervised Representations as Defense against Poisoning Attacks on Speech Commands Classification System

    Jun 27, 2026Thomas Thebaud, Sonal Joshi, Henry Li +4Backdoor AttacksAutomatic Speech Recognition

  16. Rethinking Molecular Graph Backdoors under Chemistry-aware Admission

    Jun 22, 2026Thinh T. H. Nguyen, Sze Jue Yang, Khoa D. Doan +2Graph Neural NetworksBackdoor Attacks

  17. InstantForget: Update-Free Backdoor Unlearning with Inference-Time Feature Reset

    Jun 14, 2026Zhenyu YuBackdoor DefenseMachine Unlearning

  18. Rethinking Backdoor Adversarial Unlearning through the Lens of Catastrophic Forgetting in Continual Learning

    Jun 12, 2026Zhenqian Zhu, Yamin Hu, Yujiang Liu +5Backdoor DefenseMachine Unlearning

  19. PolicyGuard: Towards Test-time and Step-level Adversary (Backdoor) Defense for Reinforcement Learning Agent

    Jun 11, 2026Junfeng Guo Heng HuangBackdoor AttacksBackdoor Defense

  20. Dummy Backdoor as a Defense: Removing Unknown Backdoors via Shared Internal Mechanisms for Generative LLMs

    Jun 10, 2026Kazuki Iwahana, Masaru Matsubayashi, Takuma Koyama +3LLM Backdoor AttacksBackdoor Defense in LLMs

  21. Backdoor Unlearning Generalization: A Path Toward the Removal of Unknown Triggers in LLMs

    Jun 2, 2026Lisa Bouger, Théo Lasnier, Philippe Loubet Moundi +2LLM Backdoor AttacksBackdoor Defense in LLMs

  22. Patcher: Post-Hoc Patching of Backdoored Large Language Models

    Jun 2, 2026Anjun Gao, Yueyang Quan, Yufei Xia +2LLM Backdoor AttacksBackdoor Attacks

  23. From Prompt Injection to Persistent Control: Defending Agentic Harness Against Trojan Backdoors

    May 29, 2026Jiejun Tan, Zhicheng Dou, Xinyu Yang +4Prompt InjectionLLM Agent Security

  24. TimeGuard: Channel-wise Pool Training for Backdoor Defense in Time Series Forecasting

    May 21, 2026Quang Duc Nguyen, Siyuan Liang, Yiming Li +2Backdoor AttacksTime Series Forecasting

  25. Provable Robustness against Backdoor Attacks via the Primal-Dual Perspective on Differential Privacy

    May 20, 2026Aman Saxena, Jan Schuchardt, Yan Scholten +1Randomized SmoothingAdversarial Robustness

  26. Trusted Weights, Treacherous Optimizations? Optimization-Triggered Backdoor Attacks on LLMs

    May 20, 2026Yifei Wang, Yida Yang, Tianlin Li +3LLM Backdoor AttacksBackdoor Attacks

  27. Your Neighbors Know: Leveraging Local Neighborhoods for Backdoor Detection in Decentralized Learning

    May 19, 2026Sayan Biswas, Antoine Boutet, Davide Frey +7Backdoor DetectionDecentralized Learning

  28. Lightweight and Fast Backdoor Model Detection

    May 17, 2026Yinbo Yu, Jing Fang, Xuewen Zhang +4Backdoor AttacksBackdoor Detection