Peak Memory

Momentum

54 papers in the last four weeks, up 157% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 279

All topics
CardsList
  1. ipc_shared_ptr: A Publish/Subscribe-Aware Smart Pointer for Cross-Process Object Lifetime Management

    May 5, 2026Takahiro Ishikawa-Aso, Atsushi Yano, Koichi Imai +2Robot Operating SystemShared Control

  2. MEMTIER: Tiered Memory Architecture and Retrieval Bottleneck Analysis for Long-Running Autonomous AI Agents

    May 5, 2026Bronislav Sidik, Lior RokachLong-Term Agent MemoryPeak Memory

  3. CERSA: Cumulative Energy-Retaining Subspace Adaptation for Memory-Efficient Fine-Tuning

    May 5, 2026Jingze Ge, Xue Geng, Yun Liu +6Parameter-Efficient Fine-Tuning MethodsPretraining

  4. OptiLookUp: An Optical ROM-Based Lookup Table Engine for Photonic Accelerators

    May 5, 2026Ankur Singh, Akhilesh JaiswalPhotonic Transformer AcceleratorsPeak Memory

  5. Safeguarding LLM Agents against Long-Horizon Threats via Shadow Memory

    May 4, 2026Yuhui Wang, Tanqiu Jiang, Jiacheng Liang +2Multi-Llm AgentsLarge Language Model Agents

  6. MemORAI: Memory Organization and Retrieval via Adaptive Graph Intelligence for LLM Conversational Agents

    May 2, 2026Hung Pham Van, Nguyen Manh Hieu, Khang Pham Tran Tuan +4Graph-Structured MemoriesPeak Memory

  7. Visual Implicit Autoregressive Modeling

    May 2, 2026Pengfei Jiang, Jixiang Luo, Luxi Lin +2Visual Autoregressive ModelsAutoregressive Image Generation

  8. MemRouter: Memory-as-Embedding Routing for Long-Term Conversational Agents

    May 1, 2026Tianyu Hu, Weikai Lin, Weizhi Zhang +2Peak MemoryAutoregressive Language Models

  9. Contextual Agentic Memory is a Memo, Not True Memory

    Apr 30, 2026Binyan Xu, Xilin Dai, Kehuan ZhangAgentic MemoryMemo

  10. Autoformalizing Memory Specifications with Agents

    Apr 30, 2026Jan Ole Ernst, Dmitri Michelangelo Saberi, Derek Christ +6Chip DesignAutoformalization

  11. QFlash: Bridging Quantization and Memory Efficiency in Vision Transformer Attention

    Apr 28, 2026Sehyeon Oh, Yongin Kwon, Jemin LeeBlock Sparse Flash AttentionQuantized

  12. Graph Memory Transformer (GMT)

    Apr 26, 2026Nicola Zanarini, Niccolò Ferrari, Evelina LammaMultiplex Graph TransformersTransformer Encoder

  13. Score-Repellent Monte Carlo: Toward Efficient Non-Markovian Sampler with Constant Memory in General State Spaces

    Apr 24, 2026Jie Hu, Lingyun Chen, Geeho Kim +3Markovian SamplingMonte Carlo

  14. Shard the Gradient, Scale the Model: Serverless Federated Aggregation via Gradient Partitioning

    Apr 23, 2026Amine BarrakFederated LearningShard

  15. StructMem: Structured Memory for Long-Horizon Behavior in LLMs

    Apr 23, 2026Buqiang Xu, Yijun Chen, Jizhan Fang +5Graph-Structured MemoriesLong-Term Memory

  16. Memorize When Needed: Decoupled Memory Control for Spatially Consistent Long-Horizon Video Generation

    Apr 20, 2026Yanjun Guo, Zhengqiang Zhang, Pengfei Wang +3Video GenerationSpatio-Temporal Attention

  17. KAIROS: Stateful, Context-Aware Power-Efficient Agentic Inference Serving

    Apr 17, 2026Yichao Yuan, Mosharaf Chowdhury, Nishil TalatiAgentic InferencePeak Memory

  18. Experience Compression Spectrum: Unifying Memory, Skills, and Rules in LLM Agents

    Apr 17, 2026Xing Zhang, Guanghui Wang, Yanwei Cui +4Large Language Model AgentsLong-Term Agent Memory

  19. PINNACLE: An Open-Source Computational Framework for Classical and Quantum PINNs

    Apr 17, 2026Shimon Pisnoy, Hemanth Chandravamsi, Ziv Chen +4Parametric Physics-Informed Neural NetworkPeak Memory

  20. MemoSight: Unifying Context Compression and Multi Token Prediction for Reasoning Acceleration

    Apr 16, 2026Xinyu Liu, Xin Liu, Bo Jin +8Multi-Token PredictionReasoning Benchmark

  21. KV Cache Offloading for Context-Intensive Tasks

    Apr 9, 2026Andrey Bocharnikov, Ivan Ermakov, Denis Kuznedelev +2Kv-Cache ManagementEfficient Long-Context Inference

  22. Flux Attention: Context-Aware Hybrid Attention for Efficient LLMs Inference

    Apr 8, 2026Quantong Qiu, Zhiyi Hong, Yi Yang +5LLM Inference OptimizationSparsity

  23. FlexServe: A Fast and Secure LLM Serving System for Mobile Devices with Flexible Resource Isolation

    Mar 10, 2026Yinpeng Wu, Yitong Chen, Lixiang Wang +3LLM Inference OptimizationDevice

  24. Evaluating Memory Structure in LLM Agents

    Feb 11, 2026Alina Shutova, Alexandra Olenina, Ivan Vinogradov +1Agentic MemoryLarge Language Model Agents

  25. StackPlanner: A Centralized Hierarchical Multi-Agent System with Task-Experience Memory Management

    Jan 9, 2026Ruizhe Zhang, Xinke Jiang, Zhibang Yang +12Global CoordinationPlanner Agent

  26. Controllable Memory Usage: Balancing Anchoring and Innovation in Long-Term Human-Agent Interaction

    Jan 8, 2026Muzhao Tian, Zisu Huang, Xiaohua Wang +8Interaction HistoryPeak Memory

  27. Vulcan: Instance-specialized, Verifiable Systems Heuristics Through LLM-driven Search

    Dec 31, 2025Rohit Dwivedula, Divyanshu Saxena, Sujay Yadalam +3Large Language Models(LlmsHeuristics

  28. Sionna RT: Technical Report

    Apr 30, 2025Fayçal Aït Aoudia, Jakob Hoydis, Merlin Nimier-David +3Radio Map EstimationRaymap-Induced Geometry

  29. LLM-Microscope: Uncovering the Hidden Role of Punctuation in Context Memory of Transformers

    Feb 20, 2025Anton Razzhigaev, Matvey Mikhalchuk, Temurbek Rahmatullaev +4Efficient Long-Context InferenceToken-Level Uncertainty

  30. XConv: Low-memory stochastic backpropagation for convolutional layers

    Jun 13, 2021Anirudh Thatipelli, Jeffrey Sam, Mathias Louboutin +3ConvolutionalBackpropagation