LLM Unlearning

LLM: Large Language Model

Momentum

20 papers in the last four weeks, up 150% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 129

All topics
CardsList
  1. Natively Unlearnable Large Language Models

    Jun 11, 2026Gaurav R. Ghosal, Pratyush Maini, Aditi RaghunathanActivation SparsityMachine Unlearning

  2. TimeROME-DLM: Temporal Causal Tracing and Low-Rank Inference-Time Knowledge Editing for Masked Diffusion Language Models

    Jun 11, 2026Zhengtao Yao, Liuyang Song, Hongbo Zhang +4Knowledge EditingMasked Diffusion Models

  3. MLUBench: A Benchmark for Lifelong Unlearning Evaluation in MLLMs

    Jun 11, 2026He Li, Haoang Chi, Qizhou Wang +6VLM UnlearningMultimodal Large Language Models

  4. Null-Space Constrained Low-Rank Adaptation for Response-Specified Large Language Model Unlearning

    Jun 9, 2026Bocheng Ju, Jianhua Wang, Chengliang Liu +1Low-Rank AdaptationLLM Unlearning

  5. Routing-Aware Expert Calibration for Machine Unlearning in Mixture-of-Experts Language Models

    Jun 9, 2026Jingyi Xie, Yijun Lin, Yinjiang Xiong +2Mixture-of-Experts Language ModelsMachine Unlearning

  6. Learning What to Forget: Improving LLM Unlearning via Learned Token-Level Importance

    Jun 4, 2026Gizem Yüce, Giorgos Nikolaou, Nicolas FlammarionMachine UnlearningLLM Unlearning

  7. Backdoor Unlearning Generalization: A Path Toward the Removal of Unknown Triggers in LLMs

    Jun 2, 2026Lisa Bouger, Théo Lasnier, Philippe Loubet Moundi +2LLM Backdoor AttacksBackdoor Defense in LLMs

  8. Don't Forget Your Embeddings: Robust Knowledge Erasure via Precise Editing of Embeddings

    Jun 2, 2026Clara Haya Suslik, Or Shafran, Mor GevaMachine UnlearningLLM Unlearning

  9. Multilingual Unlearning in LLMs: Transfer, Dynamics, and Reversibility

    Jun 2, 2026Chaoyi Xiang, Olga Ohrimenko, Benjamin I. P. Rubinstein +1Machine UnlearningLLM Unlearning

  10. Fast Unlearning at Scale via Margin Self-Correction

    Jun 1, 2026Federico Di Gennaro, Alexander Shevchenko, Fanny YangMachine UnlearningLLM Unlearning

  11. How Hard Can It Be? Hardness-Aware Multi-Objective Unlearning

    Jun 1, 2026Jiangwei Chen, Xinyuan Niu, Rachael Hwee Ling Sim +3Machine UnlearningLLM Unlearning

  12. De-attribute to Forget for LLM Unlearning

    May 29, 2026Xinyang Lu, Jiabao Pan, Rachael Hwee Ling Sim +3Machine UnlearningLLM Unlearning

  13. AMNESIA: A Large Scale Medical Unlearning Benchmark Suite with Disease-Informed Analysis

    May 28, 2026Saeedeh Davoudi, Reihaneh Iranmanesh, Ophir Frieder +1HealthcarePrivacy Leakage in Language Models

  14. MAAT: Multi-phase Adapter-Aware Targeted Unlearning

    May 28, 2026Suryash Yagnik, Shubham Gaur, Saksham Thakur +3Machine UnlearningLLM Unlearning

  15. On the Hidden Costs of Counterfactual Knowledge Training in LLM Unlearning

    May 26, 2026Xiaotian Ye, Xiaohan Wang, Mengqi Zhang +1Knowledge Conflicts in Language ModelsHallucination in Language Models

  16. Model Unlearning Objectives Vary for Distinct Language Functions

    May 26, 2026Berk Atil, Vipul Gupta, Rebecca J. PassonneauLLM SafetyMachine Unlearning

  17. SafeCtrl-RL: Inference-Time Adaptive Behaviour Control for LLM Dialogue via RL-Driven Prompt Optimisation

    May 25, 2026Michael Orme, Yanchao Yu, Zhiyuan TanRL for Language ModelsLanguage Model-Based Control

  18. Measuring the Depth of LLM Unlearning via Activation Patching

    May 23, 2026Jaeung Lee, Dohyun Kim, Jaemin JoLLM AuditingLLM Unlearning

  19. DualOptim+: Bridging Shared and Decoupled Optimizer States for Better Machine Unlearning in Large Language Models

    May 20, 2026Xuyang Zhong, Qizhang Li, Yiwen Guo +1Machine UnlearningMulti-Objective Optimization

  20. Machine Unlearning for Masked Diffusion Language Models

    May 18, 2026Georu Lee, Seungwon Jeong, Hoki Kim +2Masked Diffusion ModelsDiffusion Model Unlearning

  21. Auditing Reasoning-Trace Memorization Claims after Unlearning with Head-Conditioned Canaries

    May 17, 2026Yanhang Li, Zhichao Fan, Zexin ZhuangMemorization in Language ModelsLLM Auditing

  22. Distinguishable Deletion: Unifying Knowledge Erasure and Refusal for Large Language Model Unlearning

    May 16, 2026Puning Yang, Junchi Yu, Qizhou Wang +3LLM RefusalLLM Safety

  23. ZeroUnlearn: Few-Shot Knowledge Unlearning in Large Language Models

    May 16, 2026Yujie Lin, Chengyi Yang, Zhishang Xiang +2Privacy Leakage in Language ModelsModel Editing

  24. ASRU: Activation Steering Meets Reinforcement Unlearning for Multimodal Large Language Models

    May 15, 2026Jiahui Guang, Haiyan Wang, Yingjie Zhu +4VLM UnlearningMultimodal Large Language Models

  25. Knowledge Beyond Language: Bridging the Gap in Multilingual Machine Unlearning Evaluation

    May 14, 2026Kyomin Hwang, Hyeonjin Kim, Sangyeon Cho +1Multilingual Language Model EvaluationPrivacy Leakage in Language Models