Memorization in Language Models

Latest papers 75

All topics
CardsList
  1. When Forgetting is not Catastrophic: On the Mechanics of Spurious Forgetting

    Oct 6, 2026Vedant Palit, Florent Draye, Nicolas Zucchet +2Memorization in Language ModelsLLM Fine-Tuning

  2. How Learning Governs Unlearning across the Memorization-Generalization Spectrum

    Oct 6, 2026Hwiyeong Lee, Hyelim Lim, Ingyu Bang +2Memorization in Language ModelsMachine Unlearning

  3. Late Attention Layers Alone Can Copy Entity Tokens, but Not Without Attending to Their Context

    Sep 28, 2026Muyu He, Yuchen Liu, Ran Tao +1Memorization in Language ModelsLLM Interpretability

  4. MemoReason: Evaluating the Effect of Parametric Memory on Contextual Reasoning in LLMs

    Sep 28, 2026Zineddine Tighidet, Andrea Mogini, Jiali Mei +2LLM EvaluationMemorization in Language Models

  5. Don't Forget! Decomposing the Training Dynamics of Memorization in Language Models

    Sep 28, 2026Florian Eichin, Philipp Mondorf, Andrei Mircea +3Memorization in Language ModelsData Repetition in Language Model Training

  6. Memory vs. Context? Influential Factors of Factual Recall in Language Models

    Sep 21, 2026Guilhem Fouilhé, Nicholas Asher, Philippe MullerPrompt SensitivityMemorization in Language Models

  7. The Cost of Compression: A Rate-Distortion Limit on Factual Hallucination

    Sep 14, 2026Xi Wang, Shijia Xu, Rongfeng GuoMemorization in Language ModelsHallucination in Language Models

  8. Rebalancing Token Importance in Language Models with TF-IDF Weighted Cross-Entropy Loss

    Sep 10, 2026Zhijian Li, Stefan Larson, Kevin LeachMemorization in Language ModelsLLM Fine-Tuning

  9. Forgetting Only What Matters: Layer-Selective Unlearning toward Robust LLMs

    Sep 9, 2026Ravi Ranjan, Olivera Kotevska, Agoritsa PolyzouMemorization in Language ModelsLanguage Model Robustness

  10. From Retrieval to Weights: Parametric Individualization of Small Language Models with Individual Text Corpora

    Sep 9, 2026Christoph Wigbels, Ali Abusaleh, Markus T. Jansen +2Memory-Augmented Language ModelsMemorization in Language Models

  11. Membership Inference in Fine-tuned Diffusion Language Models via Token-level Memorization Asymmetry

    Sep 1, 2026Shengfang Zhai, Leo Marchyok, Yuling Shi +4Memorization in Language ModelsMembership Inference Attacks

  12. Balancing Privacy, Utility, and Safety in LLM Alignment through Preference Optimization

    Aug 31, 2026Dishu Yang, Jingjing Liu, Jize LiLLM AlignmentMemorization in Language Models

  13. Memorization Diagnostics for Code LLMs Should be Scale-Aware

    Aug 13, 2026Prateek Kumar Rajput, Abdoul Aziz Bonkoungou, Alberick Euraste Djiré +6Memorization in Language ModelsCode Language Models

  14. Exemplars in Disguise: Pure Exemplar Models Mimic Abstraction-First Learning

    Aug 1, 2026Zachary Nicholas Houghton, Vsevolod KapatsinskiMemorization in Language ModelsLanguage Modeling

  15. MemSFT: Mitigating Alignment Tax with an External Parametric Memory

    Jul 28, 2026Jiarui Wang, Xiang Shi, Jiaqi Cao +8LLM AlignmentMemory-Augmented Language Models

  16. Reasoning or Memorization: Can LLMs Understand and Generate Chinese Xiehouyu Riddles?

    Jul 26, 2026Hai Hu, Siyuan Song, Chongtian Shao +3LLM EvaluationMemorization in Language Models

  17. How Much Can a LoRA Adapter Memorize? Measuring Adapter Capacity in Bits

    Jul 23, 2026Kaizhen Tan, Heqing Du, Yang FengMemorization in Language ModelsPrivacy Leakage in Language Models

  18. Extractable Memorization From First Principles

    Jul 14, 2026A. Feder Cooper, Marika Swanberg, Jamie Hayes +5LLM EvaluationMemorization in Language Models

  19. MLPs are Hebbians: Constructing Efficient Fact-Storing MLPs for Transformers

    Jul 10, 2026Roberto Garcia, Jerry Liu, Ronny Junkins +3TransformerMemorization in Language Models

  20. Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training

    Jul 6, 2026Jingwei Zuo, Cong Zeng, Ilyas Chahed +6Memorization in Language ModelsNeural Network Memorization

  21. Probe Choice Changes Canary-Memorization Verdicts: Three Post-Hoc Disagreement Case Studies in a Text-Dominant LoRA-Tuned Autoregressive Testbed

    Jun 30, 2026Zhichao Fan, Zexin Zhuang, Yanhang LiMemorization in Language ModelsLLM Auditing

  22. Decomposing Memorization Reduction in Privacy-Preserving Fine-Tuning of SLMs for CSIRTs

    Jun 26, 2026Cristhian Kapelinski, Diego KreutzPrivacy-Preserving Language ModelsMemorization in Language Models

  23. Internal Data Repetition Destroys Language Models

    Jun 23, 2026Jessica Chudnovsky, Joshua Kazdan, Noam Levi +6Memorization in Language ModelsLanguage Model Scaling Laws