LLM Unlearning

LLM: Large Language Model

Momentum

20 papers in the last four weeks, up 150% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 129

All topics
CardsList
  1. Inference-Time Machine Unlearning via Gated Activation Redirection

    May 12, 2026Vinícius Conte Turani, Otávio Parraga, João Vitor Boer Abitante +7Activation SteeringMachine Unlearning

  2. Robust LLM Unlearning Against Relearning Attacks: The Minor Components in Representations Matter

    May 12, 2026Zeguan Xiao, Xuanzhe Xu, Yun Chen +4Neural Representation GeometryLLM Security

  3. Unlearners Can Lie: Evaluating and Improving Honesty in LLM Unlearning

    May 9, 2026Renjie Gu, Jiazhen Du, Yihua Zhang +1LLM UnlearningLLM Honesty

  4. Position: The Term "Machine Unlearning" Is Overused in LLMs

    May 8, 2026Sangyeon Yoon, Yeachan Jun, Albert NoLLM EvaluationMachine Unlearning

  5. SHRED: Retain-Set-Free Unlearning via Self-Distillation with Logit Demotion

    May 8, 2026Zizhao Hu, Ameya Godbole, Johnny Tian-Zheng Wei +3Machine UnlearningLLM Unlearning

  6. ICU-Bench:Benchmarking Continual Unlearning in Multimodal Large Language Models

    May 7, 2026Yuhang Wang, Wenjie Mei, Junkai Zhang +3Privacy-Preserving Language ModelsMultimodal Large Language Models

  7. Retain-Neutral Surrogates for Min-Max Unlearning

    May 7, 2026Junhao Cai, Dohun Kim, Dowon Kim +4Machine UnlearningLLM Unlearning

  8. Less is More: Geometric Unlearning for LLMs with Minimal Data Disclosure

    May 3, 2026Chenchen Tan, Xinghao Li, Shujie Cui +3Privacy-Preserving Language ModelsMachine Unlearning

  9. LLM Ghostbusters: Surgical Package Hallucination Suppression via Adaptive Unlearning

    May 1, 2026Joseph Spracklen, Pedram Aghazadeh, Farinaz Koushanfar +1LLM Hallucination MitigationHallucination in Language Models

  10. Unlearning What Matters: Token-Level Attribution for Precise Language Model Unlearning

    May 1, 2026Jiawei Wu, Doudou ZhouLLM Unlearning

  11. PrivUn: Unveiling Latent Ripple Effects and Shallow Forgetting in Privacy Unlearning

    Apr 23, 2026Xiaoyi Chen, Haoyuan Wang, Siyuan Tang +4LLM AuditingPrivacy Leakage in Language Models

  12. CAP: Controllable Alignment Prompting for Unlearning in LLMs

    Apr 23, 2026Zhaokun Wang, Jinyu Guo, Jingwen Pu +7LLM AlignmentLLM Unlearning

  13. Forget What Matters, Keep the Rest: Selective Unlearning of Informative Tokens

    Apr 20, 2026Seunghee Koh, Sunghyun Baek, Youngdong Kim +1Machine UnlearningLLM Unlearning

  14. Representation-Guided Parameter-Efficient LLM Unlearning

    Apr 19, 2026Zeguan Xiao, Lang Mo, Yun Chen +4Machine UnlearningLLM Unlearning

  15. Randomized Antipodal Search Done Right for Data Pareto Improvement of LLM Unlearning

    Apr 17, 2026Ziwen Liu, Huawei Lin, Yide Ran +5Machine UnlearningLLM Unlearning

  16. CiPO: Counterfactual Unlearning for Large Reasoning Models through Iterative Preference Optimization

    Apr 17, 2026Junyi Li, Yongqiang Chen, Ningning DingMachine UnlearningLLM Unlearning

  17. Modeling LLM Unlearning as an Asymmetric Two-Task Learning Problem

    Apr 16, 2026Zeguan Xiao, Siqing Li, Yong Wang +4Gradient InterferenceMulti-Task Learning

  18. CausalDetox: Causal Head Selection and Intervention for Language Model Detoxification

    Apr 16, 2026Yian Wang, Yuen Chen, Agam Goyal +1Causal Reasoning in Language ModelsLLM Safety

  19. GONE: Structural Knowledge Unlearning via Neighborhood-Expanded Distribution Shaping

    Feb 21, 2026Chahana Dahal, Ashutosh Balasubramaniam, Zuobin XiongMachine UnlearningLLM Unlearning

  20. CALIBURN: Self-Calibrated LLM Unlearning Alignment

    Feb 2, 2026Zhengbang Yang, Yisheng Zhong, Junyuan Hong +1LLM Unlearning

  21. Contrastive Representation Shaping for LLM Unlearning

    Jan 29, 2026Haoran Tang, Rajiv KhannaDisentangled Representation LearningMachine Unlearning

  22. Beyond Forgetting: Representation Misdirection Elicits Controllable Side Behaviors and Capabilities

    Jan 29, 2026Tien Dang, The-Hai Nguyen, Dinh Mai Phuong +5Linear Representation HypothesisControllable Text Generation

  23. BalDRO: A Distributionally Robust Optimization based Framework for Large Language Model Unlearning

    Jan 14, 2026Pengyang Shao, Naixin Zhai, Lei Chen +4Distributionally Robust OptimizationLLM Unlearning

  24. A Fast and Effective Solution to the Problem of Look-ahead Bias in LLMs

    Dec 7, 2025Humzah Merchant, Bradford LevyLLM-Based Time Series ForecastingLLM Unlearning

  25. RapidUn: Influence-Driven Parameter Reweighting for Efficient Large Language Model Unlearning

    Dec 4, 2025Guoshenghui Zhao, Huawei Lin, Weijie ZhaoMachine UnlearningLLM Unlearning