LLM Memory

LLM: Large Language Model

Latest papers 73

All topics
CardsList
  1. MemPilot: Orchestrating On-Demand Multimodal Memory Curation for LLM Agents

    Oct 5, 2026Haozhen Zhang, Haodong Yue, Quanyu Long +6LLM Agent MemoryLLM Memory

  2. Causal Memory Policy: Making Memory Utility Identifiable by Intervening on Retrieval

    Oct 1, 2026Arman Behnam, Binghui WangLLM MemoryCausal Inference

  3. Learning What to Remember: Long-horizon Counterfactual Memory Optimization

    Sep 29, 2026Jiaming Tang, Mingyan Liu, Armin SarabiMemory-Augmented Language ModelsPersistent Memory for Language Models

  4. FactorEngram: Factorized N-gram Memory with Basis-Level Gating for Language Models

    Sep 28, 2026Bowen Yang, Jingbo Zhou, Qinghong Miao +1Memory-Augmented Language ModelsLLM Memory

  5. DPS: Dual-Mode Precision LLM Serving with Semi-Unified Memory

    Sep 28, 2026Xuan Truong Nguyen, Tien Son Pham, Tuan Duc Chu +2LLM ServingLLM Inference

  6. Positions Are Not Facts: The Mismatch Between KV Caches and Memory

    Sep 27, 2026Changhai Zhou, Yuhua Zhou, Shiyang Zhang +5Knowledge EditingKnowledge Conflicts in Language Models

  7. Grounding Memory Summarization in Utility Intent

    Sep 27, 2026Zhenyu Lei, Mingjia Shi, Xingbo Fu +3Conversational MemoryLLM Memory

  8. LSTMem: Hierarchical Long Short-Term Online Memory for Large Language Models

    Sep 27, 2026Xianglong Shi, Ruijie Yang, Sirui Zhao +4Memory-Augmented Language ModelsPersistent Memory for Language Models

  9. Complementary Roles of Activation and Parametric Memory in Few-Shot Learning

    Sep 23, 2026Miaohe Niu, Runsong Zhao, Xinyu Liu +5LLM MemoryFew-Shot Learning

  10. SpeakerMem-R1: Speaker-Centered Dual-Track Memory for Multi-Party Dialogue

    Sep 22, 2026Haobo Zheng, Tan Tang, Yan Chen +2Conversational MemoryLLM Memory

  11. The Cost of Compression: A Rate-Distortion Limit on Factual Hallucination

    Sep 14, 2026Xi Wang, Shijia Xu, Rongfeng GuoMemorization in Language ModelsHallucination in Language Models

  12. Mitigating Over-Personalization in LLMs via Structured Memory

    Aug 8, 2026Hakeem Hannoon, Andrew Zhao, Mihir Narayan +2LLM SycophancyPersistent Memory for Language Models

  13. PsychoAgent: An Affect-Sensitive Cognitive Architecture for Conflict-Aware Memory in LLM Agents

    Aug 7, 2026Mohammad Amanlou, Parham Abed Azad, Farbod Davoodi +3Cognitive Architectures for AI AgentsLLM Agent Memory

  14. From Test-Time Scaling to Reusable Memory: Measuring Crystallization in Text-to-SQL

    Aug 7, 2026Jiaqian Wang, Yutao Qi, Wenjin Hou +2LLM MemoryText-to-SQL

  15. Runtime Observability for Heterogeneous Attention Memory

    Aug 6, 2026Fanzhe Wei, Li Liu, Ziyang Wang +1KV CachingLLM Auditing

  16. LiveMem: Maintaining Memory State Continuity in Long-Running LLM Inference

    Aug 3, 2026Zhichen Liu, Ruihan Sun, Hengjie Yang +4Memory-Augmented Language ModelsLLM Inference

  17. V-Mem: Modality-Routed Retrieval for Long-Term Multimodal Agentic Memory

    Aug 2, 2026Dingyi Kang, Dongming Jiang, Yi Li +2Multimodal IRMultimodal Memory

  18. ΣΣ-Mem: An Online Reliability Memory for LLM-based Multi-Agent Systems

    Jul 30, 2026Peilin Feng, Suorong Yang, Soujanya PoriaAI Agent ReliabilityMulti-Agent LLM Systems

  19. ForgetBench: Benchmarking Forgetting Dynamics of Long-Term Parametric Memory in Language Models

    Jul 29, 2026Ruxi Gu, Zhenliang Zhang, Wei WangKnowledge EditingContinual Learning for LLMs

  20. Memory for Large Language Models

    Jul 28, 2026Sining Zhoubian, Dan Zhang, Evgeny Kharlamov +1Memory-Augmented Language ModelsLLM Memory

  21. Eviction as Estimation: A Fixed-Lag Smoothing View of Test-Time Memory, and When Measuring Beats Accumulating

    Jul 27, 2026Maruthi Vemula, Neeraj Praneeth GajulaKV CachingKV-Cache Eviction

  22. From Observation to Intervention: Memory in Brains and Large Language Models

    Jul 27, 2026Morteza Salehjahromi, Shayan A. Zadegan, Amgad Muneer +1LLM Memory

  23. Presentation, Not Mechanism: A Render Confound in Deprecation-Aware Memory Evaluation

    Jul 17, 2026Zhaoyang Jiang, Zhizhong Fu, Zicheng Li +5LLM MemoryQuestion Answering

  24. Creativity, honesty and designed forgetting emerge in small hyperbolic language models

    Jul 10, 2026Kwan Soo Shin, In Seok Kang, Yunkyung MinLLM SycophancyMemory-Augmented Language Models

  25. What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents

    Jul 9, 2026Ashwin Gerard Colaco, Nada LahjoujiRate-Distortion TheoryLLM Memory

  26. MemDefrag: Latent Memory Defragmentation for Large Language Models

    Jul 7, 2026Ruiyi Yan, Zhuoyuan Mao, Yiwen GuoContinual Learning for LLMsMemory-Augmented Language Models