LLM Unlearning

LLM: Large Language Model

Momentum

20 papers in the last four weeks, up 150% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 129

All topics
CardsList
  1. Not Every Change Is Necessary: Recoverable Drift in Large Language Model Unlearning

    Oct 8, 2026Xunlei Chen, Qinghui Gong, Jingkun Xue +3Machine UnlearningLLM Unlearning

  2. Nullify: Null-Space Activation Steering for Training-Free LLM Unlearning

    Oct 7, 2026Wei Zhai, Xiang Liu, Qiang Huang +6LLM UnlearningPrivacy Leakage in Language Models

  3. How Learning Governs Unlearning across the Memorization-Generalization Spectrum

    Oct 6, 2026Hwiyeong Lee, Hyelim Lim, Ingyu Bang +2Memorization in Language ModelsMachine Unlearning

  4. LLM Persona Unlearning

    Sep 30, 2026Kemou Li, Zhuan Shi, Qizhou Wang +4Model EditingPersona-Conditioned Generation

  5. Preemptive LLM Unlearning against Forbidden Capability Acquisition via Gradient Sealing

    Sep 30, 2026Kemou Li, Qizhou Wang, Yue Wang +6LLM SecurityLLM Safety

  6. Faithful Dual-constrained Erasure for Robust LLM Safety Alignment

    Sep 30, 2026Jiaqing Li, Shide Zhou, Zhibo Zhang +3LLM Safety AlignmentMachine Unlearning

  7. Learning What to Forget: Distributional Unlearning for LLM Representation Spaces

    Sep 30, 2026Pinaki Mohanty, Haoran Tang, Maggie Makar +1Density Ratio EstimationMachine Unlearning

  8. Unlearning Deceptive Behaviors in LLMs with Contrastive Forget Sets

    Sep 30, 2026Haoran Tang, Rajiv KhannaDeception in Language ModelsMachine Unlearning

  9. Storage Is Not Strategy: State-Conditioned Support Control for LLM Unlearning

    Sep 29, 2026Tianhao Qian, Ziming Hong, Chongyang Gao +2Machine UnlearningLLM Unlearning

  10. LLM unbranding: Erasing Commercial Identity while Preserving Generic Utility

    Sep 29, 2026Kajetan Ożóg, Alicja Wojciechowska, Dawid Malarz +3Prompt OptimizationLLM Unlearning

  11. UNBIND: UNlearning By INference-time Directional Steering for Code LLMs

    Sep 28, 2026Zhengyang Shan, Jiayun Xin, Yanjun Lin +7Activation SteeringLLM Unlearning

  12. TULIP: Targeted LLM Unlearning at Layers Identified Per-Input

    Sep 28, 2026Yejin Kim, William F. Shen, Seokwon Jung +2Machine UnlearningLLM Unlearning

  13. Causal Routing for Unlearning

    Sep 28, 2026Bardh Prenkaj, Andrea D'Angelo, Davide Mottin +4Causal Interventions in Language ModelsMachine Unlearning

  14. Making LLMs Truly Forget: Deep Unlearning by Searching, Selecting, and Severing Knowledge Paths

    Sep 28, 2026Jialu Wang, Peizhi Niu, Haoteng Yin +3Factual Knowledge in Language ModelsMachine Unlearning

  15. Trajectory Unlearning on LLM-based Agents

    Sep 27, 2026Yingdan Shi, Ren WangLong-Horizon Agent TasksLLM Unlearning

  16. The Tokens Remember: When Tokenization Bypasses Knowledge Editing and Unlearning

    Sep 24, 2026Manit Baser, Aditya Nawal, Dinil Mon Divakaran +1Adversarial Attacks on LLMsPrivacy Leakage in Language Models

  17. Quantization-Robust Unlearning through the Lens of Retain-Forget Loss Landscapes Interaction

    Sep 23, 2026Jialu Wang, Jianing Deng, Shuqing Luo +6Machine UnlearningLLM Unlearning

  18. GUARD: Natural Forgetting in Large Reasoning Models via Guided Answer-Reasoning Distillation

    Sep 18, 2026Zeyu Yan, Guanghao Zhou, Minghui Qiu +2Privacy Leakage in Language ModelsMachine Unlearning

  19. Cascade: Hierarchical Recoverability Control for Large Language Model Unlearning

    Sep 15, 2026Qingchen Yu, Shiying Duan, Xiaodong Li +5Privacy Leakage in Language ModelsMachine Unlearning

  20. Test-Time Unlearning via Sparse Autoencoder

    Sep 14, 2026Pingzhi Li, Jinhao Duan, Vaishnav Tadiparthi +6Machine UnlearningLLM Unlearning

  21. K-Bench: A Benchmark for LLM Unlearning in Agentic Deployments

    Sep 11, 2026Guangsheng Yu, Yanna Jiang, Qin Wang +2LLM Agent EvaluationPrivacy Leakage in Language Models

  22. Forgetting Only What Matters: Layer-Selective Unlearning toward Robust LLMs

    Sep 9, 2026Ravi Ranjan, Olivera Kotevska, Agoritsa PolyzouMemorization in Language ModelsLanguage Model Robustness

  23. Extracting Forgotten Prompts from Targeted Unlearned Models

    Sep 3, 2026Au Ashley Hoi-Ting, Meghdad Kurmanji, William F. Shen +2Privacy Leakage in Language ModelsLLM Unlearning

  24. On the Recoverability of Private Information Unlearning in Large Language Models

    Aug 30, 2026Shicheng Hu, Runzhi Tian, Ziqiao Wang +1LLM AuditingPrivacy Leakage in Language Models

  25. Stress Testing Unlearning Algorithms

    Aug 23, 2026Noam Diamant, Neta Glazer, Ethan FetayaLLM Safety BenchmarksMachine Unlearning

  26. Measure, Don't Optimize: Forecasting Recovery in LLM Unlearning

    Aug 11, 2026Zirui Song, Huaxing Liu, Xiang Wang +8LLM AuditingMachine Unlearning