Large Language Model Memory

Latest papers 132

All topics
CardsList
  1. EngramEdit: Decoupled Knowledge Updates in LLMs through Conditional Memory

    Oct 7, 2026Hongru Cai, Ran Wei, Wenjie Wang +4Multimodal Knowledge EditingLarge Language Model Memory

  2. Cache the Encoder Within:Compact, Reusable Memory across LLM Queries

    Oct 7, 2026Hanzuo Liu, Chunyu Liu, Chaofan Lin +2Large Language Model Memory

  3. Decoupling Memory from Context: Structured Memory for Token-Efficient Test-Time Continual Learning

    Oct 2, 2026Yehya Farhat, Michael Desmond, Anastasios KyrillidisLarge Language Model MemoryGraph-Structured Memories

  4. Local Support Learning

    Oct 1, 2026Assaf Ben-Kish, Akarsh Kumar, James Glass +1Catastrophic ForgettingLarge Language Model Memory

  5. Causal Memory Policy: Making Memory Utility Identifiable by Intervening on Retrieval

    Oct 1, 2026Arman Behnam, Binghui WangLarge Language Model MemoryRetention

  6. CoEM: Empowering Long-Context Reasoning with Commit-on-Evidence Memory

    Sep 29, 2026Jingguang Li, Yebo Wu, Zuyi Guo +7Long-Context ReasoningLLM Reasoning Strategies

  7. FactorEngram: Factorized N-gram Memory with Basis-Level Gating for Language Models

    Sep 28, 2026Bowen Yang, Jingbo Zhou, Qinghong Miao +1Unigram TokenizerLarge Language Model Memory

  8. Causal Routing for Unlearning

    Sep 28, 2026Bardh Prenkaj, Andrea D'Angelo, Davide Mottin +4Large Language Model MemoryCausal

  9. Making LLMs Truly Forget: Deep Unlearning by Searching, Selecting, and Severing Knowledge Paths

    Sep 28, 2026Jialu Wang, Peizhi Niu, Haoteng Yin +3Large Language Model UnlearningForgetting

  10. Positions Are Not Facts: The Mismatch Between KV Caches and Memory

    Sep 27, 2026Changhai Zhou, Yuhua Zhou, Shiyang Zhang +5Key-Value CacheLarge Language Model Memory

  11. Just Let Linear States Forget the Distant Past: Prefix Caching via Suffix Replay for Hybrid LLMs

    Sep 27, 2026Yirui Liu, Ruoling Qi, Xuaner Wu +6Kimi Delta AttentionCache

  12. LSTMem: Hierarchical Long Short-Term Online Memory for Large Language Models

    Sep 27, 2026Xianglong Shi, Ruijie Yang, Sirui Zhao +4Large Language Model MemoryPeak Memory

  13. When Fancy Eviction Fails: Rethinking Cache Replacement For LLM Prefix Reuse

    Sep 24, 2026Yiyu Liu, Minlan Yu, Juncheng YangEvictionCache

  14. Compressing Long Context into Answer-Aligned Memory Embeddings for LLM Inference

    Sep 22, 2026Md Mostafizer Rahman, Md Faizul Ibne Amin, Md Shahajada Mia +2LLM Inference OptimizationLarge Language Model Memory

  15. Memory vs. Context? Influential Factors of Factual Recall in Language Models

    Sep 21, 2026Guilhem Fouilhé, Nicholas Asher, Philippe MullerLarge Language Model MemoryFactual Recall

  16. TierKV: Long-Context On-Device LLMs via Predictive Multi-Tier KV Caching

    Sep 18, 2026Zhihao Shu, Md Musfiqur Rahman Sanim, Jie Hu +4Kv-Cache ManagementDepthweave-Kv

  17. MoME: Mixture-of-Memory Embeddings for Context-Aware Sparse Lookup

    Sep 14, 2026Muchen Li, Leonid Sigal, Renjie LiaoLarge Language Model Memory

  18. Rebalancing Token Importance in Language Models with TF-IDF Weighted Cross-Entropy Loss

    Sep 10, 2026Zhijian Li, Stefan Larson, Kevin LeachLarge Language Model MemoryTerm Frequency-Inverse Document Frequency

  19. ConvMem: Convolutional Memory for Long-Context Reasoning

    Sep 9, 2026Hongming Zhang, Zhaozhen Gu, Fengshuo Bai +6Efficient Long-Context InferenceLarge Language Model Memory

  20. Forgetting Only What Matters: Layer-Selective Unlearning toward Robust LLMs

    Sep 9, 2026Ravi Ranjan, Olivera Kotevska, Agoritsa PolyzouLarge Language Model UnlearningLarge Language Model Quantization

  21. From Retrieval to Weights: Parametric Individualization of Small Language Models with Individual Text Corpora

    Sep 9, 2026Christoph Wigbels, Ali Abusaleh, Markus T. Jansen +2Large Language Model MemorySmall Large Language Models

  22. Separating Stream Stability from Long-Term Recall in Language Models

    Sep 7, 2026Peipei Cao, Xin Zhang, Jie Tang +3Large Language Model MemoryEfficient Long-Context Inference

  23. SGD-KV: Summarization Guided KV Cache Compression

    Sep 3, 2026Zeyu Liu, Woomin Song, Xuandi Fu +5Key-Value Cache CompressionEfficient Long-Context Inference

  24. LatentPress: Context Compression Beyond Text and Vision

    Sep 1, 2026Zhengze Zhou, Hejian SangEfficient Long-Context InferenceLarge Language Model Compression

  25. mzCache: On-Device LLM Memory Management under Multitasking

    Sep 1, 2026Hongseung Yu, Minsung Kim, Jongseok Park +1LLM Inference OptimizationLarge Language Model Memory

  26. What It Costs to Compose, Rebuild, and Correct Precomputed Memory

    Aug 31, 2026Asa ShepardLarge Language Model MemoryKey-Value Cache

  27. When Errors Become Memories: Causal Pathway Tracing in Multi-Turn Memory-Augmented LLMs

    Aug 31, 2026Shuyao Xiao, Shengling Wang, Xuan Chen +8Large Language Model MemoryLarge Language Models Fail

  28. Sliding-window beats linear attention

    Aug 28, 2026Alexia Jolicoeur-Martineau, Rhea Sanjay Sukthanker, Pashmina Cameron +1Kimi Delta AttentionLarge Language Model Memory

  29. Mitigating Over-Personalization in LLMs via Structured Memory

    Aug 8, 2026Hakeem Hannoon, Andrew Zhao, Mihir Narayan +2Large Language Model MemoryLong-Term Memory

  30. When Does Latent Communication Pay? A Causal Audit of Relayed KV Caches in Multi-Agent LLMs

    Aug 5, 2026Jiaming Cheng, Subhransu Das, Rajiv RamnathMulti-Agent Large Language Model SystemsLarge Language Model Memory

  31. PI-Mem: Pushing Long-Context Reasoning to 3.6M Tokens with Parallel-Iterative Memory

    Aug 4, 2026Dawei Liu, Haixu Song, Shuang Cheng +9Long-Context ReasoningLarge Language Model Memory

  32. Structured Memory for Edge Language Models: Persistent Context and Corpus Retrieval via O(1) SSM State Injection

    Aug 3, 2026Anusha Madan Gopal, Aras Pirbadian, Kristofor D. Carlson +2Large Language Model MemoryEfficient Long-Context Inference

  33. LiveMem: Maintaining Memory State Continuity in Long-Running LLM Inference

    Aug 3, 2026Zhichen Liu, Ruihan Sun, Hengjie Yang +4Large Language Model MemoryPersistent State

  34. TransMem: Transforming Hidden States into Memory for Large Language Models

    Jul 31, 2026Haodong Lei, Junming Liu, Yirong Chen +4Large Language Model MemoryLarge Language Model Agents

  35. Back from the Future: Key-Value Cache Management by Counter-Causal Surprise

    Jul 30, 2026Stephen Gould, Anton van den HengelKey-Value CacheCache

  36. InferScale: GPU-Native KV Injection for Personalized LLM Serving

    Jul 29, 2026Peter Li, Prashant PandeyLarge Language Model MemoryKv-Cache Management

  37. LLMET: Enabling Cross-Layer Evaluation of Emerging M3D Memories for Energy-Efficient LLM Serving

    Jul 29, 2026Ming-Yen Lee, Hanchen Yang, Faaiq Waqar +4Large Language Model MemoryVram

  38. ForgetBench: Benchmarking Forgetting Dynamics of Long-Term Parametric Memory in Language Models

    Jul 29, 2026Ruxi Gu, Zhenliang Zhang, Wei WangLarge Language Model MemoryCatastrophic Forgetting

  39. MemLens: A Value-Aware Memory Management System with Interactive Analytics for LLM-based Agents

    Jul 28, 2026Shuyue Wei, Chang Liu, Zimu Zhou +2Large Language Model MemoryPeak Memory

  40. Memory for Large Language Models

    Jul 28, 2026Sining Zhoubian, Dan Zhang, Evgeny Kharlamov +1Large Language Model MemoryPeak Memory

  41. From Observation to Intervention: Memory in Brains and Large Language Models

    Jul 27, 2026Morteza Salehjahromi, Shayan A. Zadegan, Amgad Muneer +1Large Language Model MemoryEpisodic Memory

  42. HijackKV: New Threat in Position-Independent KV Cache Reuse

    Jul 22, 2026Yichi Zhang, Zhiqi Wang, Huan Zhang +1Key-Value CacheCache

  43. SALT: Salience-Aware Lexical Trie for Long-Context Compression

    Jul 20, 2026Oteo Mamo, Hyunjin Yi, Joydhriti Choudhury +2Efficient Long-Context InferenceLarge Language Model Memory

  44. Beyond Memory Leaderboards: Evaluating Scientific Memory as Budgeted Context Restoration

    Jul 18, 2026Maksim Sheverev, David Finkelstein, Sergey NikolenkoLarge Language Model MemoryScientific Discovery

  45. Can a Language Model Learn Facts Continually in Its Weights?

    Jul 13, 2026Charles O'Neill, Max Kirkby, Jonathon Liu +1Large Language Model MemoryFacts

  46. MemDecay: Region-Aware KV Cache Eviction for Efficient LLM Agent Inference

    Jul 12, 2026Venkatesha Matam, Keon KimKey-Value Cache EvictionKv-Cache Management

  47. MLPs are Hebbians: Constructing Efficient Fact-Storing MLPs for Transformers

    Jul 10, 2026Roberto Garcia, Jerry Liu, Ronny Junkins +3Large Language Model MemoryTransformer Architectures

  48. Towards Efficient Large Language Model Serving: A Survey on System-Aware KV Cache Optimization

    Jul 9, 2026Jiantong Jiang, Peiyu Yang, Rui Zhang +1Kv-Cache ManagementLarge Language Model Serving

  49. What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents

    Jul 9, 2026Ashwin Gerard Colaco, Nada LahjoujiCompactionLarge Language Model Memory