LLM Unlearning

LLM: Large Language Model

Momentum

20 papers in the last four weeks, up 150% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 129

All topics
CardsList
  1. Backdoor Decontamination Dynamics in LLM Agents

    Aug 11, 2026Gabriel Huang, Abhay Puri, Léo Boisvert +4LLM Backdoor AttacksBackdoor Defense in LLMs

  2. GROM: Gradient-Free Rapid One-Shot Machine Unlearning

    Aug 6, 2026Paweł Batorski, Przemysław Spurek, Paul SwobodaMachine UnlearningLLM Unlearning

  3. A Model Merging Approach for Continual MLLM Unlearning

    Aug 5, 2026Yuhang Wang, Linlin Zhang, Haoxuan Ji +3Multimodal Large Language ModelsMLLM Unlearning

  4. Leak-Resistant Unlearning: A New Benchmark for Evaluating Multi-Hop Reasoning Consistency and Recovery Robustness

    Aug 5, 2026Haoting Qian, Qingjie Zhang, Zhicong Huang +2Multi-Hop ReasoningLanguage Model Robustness

  5. Trajectory-Guided Forget-Recover Network for Continual LLM Unlearning

    Aug 4, 2026Zezheng Wu, Xinghe Cheng, Qinggang Zhang +4Machine UnlearningLLM Unlearning

  6. Exploring and Bridging Knowledge Holes in Unlearned Multimodal Large Language Models

    Aug 3, 2026Junxiang You, Junkai Chen, Yuhao He +3Multimodal Large Language ModelsMLLM Unlearning

  7. Beyond Binary Rewards: A Comparative Study of Reward Design for Reinforcement Unlearning

    Jul 30, 2026Efstratios Zaradoukas, Davide Gabrielli, Bardh Prenkaj +1Reinforcement Learning with Verifiable RewardsMachine Unlearning

  8. Crossing the Margin Cliff: Toward Relearn-Robust LLM Unlearning via Margin Calibration

    Jul 30, 2026Xiangyu Yin, Jiaxu Liu, Zhen Chen +1Privacy Leakage in Language ModelsLLM Unlearning

  9. Stochastic Meta-Unlearning: Bridging Language Backbone and Multimodal Unlearning

    Jul 21, 2026Zijie Liu, Jinhao Duan, Gaowen Liu +2VLM UnlearningVision-Language Models

  10. Forget Narrowly, Retain Broadly: Unlearning as an Asymmetric Generalization Problem

    Jul 10, 2026Amit Peleg, Naman Deep Singh, Naama Pearl +2Factual Knowledge in Language ModelsMachine Unlearning

  11. POPS: Recovering Unlearned Multi-Modality Knowledge in MLLMs with Prompt-Optimized Parameter Shaking

    Jul 7, 2026Zhangheng LI, Jianing Zhu, Junyuan Hong +4Multimodal Large Language ModelsPrivacy Leakage in Language Models

  12. MPSelectTune: Prompt-type Selection for Fine-tuning improves Concept Unlearning in LLMs

    Jul 4, 2026Shubhadip Nag, Srinjoy Das, Agniva Saha +5LLM Fine-TuningMachine Unlearning

  13. LACUNA: A Testbed for Evaluating Localization Precision for LLM Unlearning

    Jul 2, 2026Matteo Boglioni, Thibault Rousset, Siva Reddy +2Privacy Leakage in Language ModelsMachine Unlearning

  14. Auditing Forgetting in Limited Memory Language Models

    Jul 1, 2026Arya Raeesi, Hanna RoedMemory-Augmented Language ModelsLLM Auditing

  15. MemLeak: Diagnosing Information Leaks in Multimodal Agent Memory

    Jun 29, 2026Kuan Wang, Chao ZhangAgent MemoryMultimodal Memory

  16. CBD: API-Only LLM Black-Box Unlearning through Controlled Behavioral Divergence

    Jun 26, 2026Zhiqiang Xie, Yijing Lin, Zhipeng Gao +1Machine UnlearningLLM Unlearning

  17. Natural Ungrokking: Asymmetric Control of Which Rules Survive Pretraining

    Jun 24, 2026Juliana Li, Diya SreedharLanguage Model PretrainingLLM Unlearning

  18. Detect, Unlearn, Restore: Defending Text Summarization Models Against Data Poisoning

    Jun 24, 2026Poojitha Thota, Shirin NilizadehLLM AuditingLLM Fine-Tuning

  19. Uncertainty-based Debiasing and Unlearning for Decontamination

    Jun 22, 2026Guangzhi Sun, Xiao Zhan, Mark GalesData Contamination in Language ModelsLLM Unlearning

  20. Mechanism-Guided Selective Unlearning for RLVR-Induced Reasoning

    Jun 17, 2026Chenyu Zhou, Qiliang Jiang, Shuning Wu +1Machine UnlearningLLM Unlearning

  21. Output Vector Editing for Memorization Mitigation in Large Language Models

    Jun 17, 2026Ahmad Dawar Hakimi, Kaiwei Lei, Isabelle Augenstein +1Memorization in Language ModelsNeural Network Memorization

  22. PreUnlearn: Auditing Collateral Knowledge Damage Before Large Language Model Unlearning

    Jun 16, 2026Bo Su, Ankit Shah, Thai LeLLM AuditingMachine Unlearning

  23. SAGE: Retain-Aware Post-Hoc Sanitization of Final Unlearning Vector

    Jun 16, 2026Jingyuan Zhang, Yucheng Bai, Peixi Wen +6Machine UnlearningLLM Unlearning

  24. RepSelect: Robust LLM Unlearning via Representation Selectivity

    Jun 15, 2026Filip Sondej, Yushi Yang, Adam MahdiLLM SafetyRepresentation Geometry in Language Models

  25. Replay What Matters: Off-Policy Replay for Efficient LLM Reinforcement Unlearning

    Jun 13, 2026Zirui Pang, Chenlong Zhang, Haosheng Tan +3Experience ReplayMachine Unlearning