Bounded-Memory

Momentum

10 papers in the last four weeks, up 100% on the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 47

All topics
CardsList
  1. MemEvo: Automatic Discovery of Streaming Video Memory Mechanisms

    Sep 29, 2026Guohong Liu, Jialei Ye, Shanhui Zhao +2Streaming Video UnderstandingBounded-Memory

  2. BRIDGE: Bilevel Retrieval-Credit-Aware Agentic Reinforcement Learning

    Sep 29, 2026Quan Xiao, Mingda Liu, Gaowen Liu +2Agentic Reinforcement LearningLarge Language Model Policy Optimization

  3. SANTA++: Sampling Attention through Representative Keys

    Sep 28, 2026Kyle Lee, Christian Z. Pratt, Ruoyu Fang +4Dynamic Sparse AttentionBounded-Memory

  4. ReplayLens: Auditing Agents' Use of Outcomes

    Sep 28, 2026Dong Xu, Zhangfan Yang, Jiantao Wu +5ReplayInteraction History

  5. DeltaS: Reading the Gated Linear Attention State for KV Cache Eviction in Streaming Video

    Sep 23, 2026Taeyoun Kwon, Seungjin Kim, Hyeonyu Kim +1Kimi Delta AttentionLinear Attention

  6. MORSE: Multi-Context Ordering via Reverse Scoring for Evidence-Preserving Compression

    Sep 23, 2026Ke Wan, Yifan Wang, Liheng Lai +1Data Compression MethodsBounded-Memory

  7. CliffCompaction: Cost-Efficient Compaction for Long-Horizon Coding Agents

    Sep 22, 2026Trang Nguyen, Eulrang Cho, Bingqing Chen +1CompactionBounded-Memory

  8. Beyond Class Marginals: Bounding Rehearsal Gaps without Freezing Class Co-occurrence

    Sep 22, 2026Congren Dai, Nat Roongjirarat, Fei YeLayer-Selective Rehearsal StrategyDeterministic Replay

  9. Temporal Recurrence Favors Fewer Layers

    Sep 14, 2026Ivan Anokhin, Johan Obando-Ceron, Irina Rish +1Recurrent ModelRecurrence

  10. Sparse Weight and Edge Circuit Discovery in Transformer-based Acoustic Models

    Sep 11, 2026Jiankun Wei, Ewan Dunbar, Gerald PennTransformer EncoderNeural Audio

  11. Superposed Latent Autoencoder

    Sep 1, 2026Quanling Zhao, Jiaying Yang, Tianqi Zhang +4Autoencoder ArchitecturesFuture Latent Representations

  12. StreamScout: Learning When to Look Deeper for Streaming Video Understanding

    Aug 31, 2026Ce Zhang, Jing Bi, Jinxi He +9Streaming Video UnderstandingBounded-Memory

  13. DASC: Decay-Aware State Compression for Hybrid Linear-Attention Serving

    Aug 31, 2026Yanqi Yu, Pingwei Sun, Jianchao Tan +4Kimi Delta AttentionRecurrent State

  14. SubZero+: Memory-Efficient Adaptive Zeroth-Order LLM Fine-Tuning in Random Subspaces

    Aug 16, 2026Ziming Yu, Shuyao Xiao, Xingyu Zhao +6Zeroth-OrderLarge Language Model Fine-Tuning

  15. Batch Size or Negatives? A Selection Rule for Memory-Constrained Recommender Training

    Aug 11, 2026Artyom Sabitov, Daniil Volkov, Alexey ZaytsevReal-World Content Recommendation ProblemBounded-Memory

  16. MESH: Memory-Efficient Sinkhorn Optimization for Mixture-of-Experts Training

    Aug 5, 2026Masato FujitakeMixture-Of-ExpertsAdam

  17. FlashTrie: A GPU-Accelerated Constrained Beam Search for Generative Retrieval

    Jul 10, 2026Dakshitha Anandakumar, Anurag Mukkara, Wenxiang Hu +5Beam SearchConstrained Decoding

  18. KVpop -- Key-Value Cache Compression with Predictive Online Pruning

    Jul 6, 2026Lukas Hauzenberger, Niklas Schmidinger, Anamaria-Roberta Hartl +5Key-Value Cache EvictionKey-Value Cache Compression

  19. AgenticSTS: A Bounded-Memory Testbed for Long-Horizon LLM Agents

    Jul 2, 2026Xiangchen Cheng, Yunwei Jiang, Jianwen Sun +7Long-Term Agent MemoryStrategic Reasoning

  20. Space-Efficient Language Generation in the Limit

    Jun 24, 2026Nicolas Flammarion, Chirag Pabbaraju, Hristo Papazov +2Bounded-MemoryOptimal Sample Complexity

  21. Unifying Data, Memory, and Compute Efficiency in LLM training: A Survey

    Jun 9, 2026Vanessa Schmidt, Huy Hoang Nguyen, Cédric Jung +2Alignment-Aware SelectionLarge Language Model Training

  22. On Language Generation in the Limit with Bounded Memory

    May 28, 2026Jon Kleinberg, Anay Mehrotra, Amin Saberi +1Bounded-MemoryLearnability

  23. Approaching I/O-optimality for Approximate Attention

    May 22, 2026Pál András Papp, Aleksandros Sobczyk, Anastasios ZouziasKimi Delta AttentionMatrix Multiplication

  24. Memory-Efficient Partitioned DNN Inference on Resource-Constrained Android Crowds

    May 20, 2026Lakshani Manamperi, Disumi Pathirana, Thiwanka Pathirana +2Resource-Constrained Edge DevicesNeural Network Inference

  25. Minimal-Intervention KV Retention via Set-Conditioned Diversity

    May 14, 2026Libo Sun, Po-wei Harn, Peixiong He +1Key-Value Cache CompressionCache

  26. KV-Fold: One-Step KV-Cache Recurrence for Long-Context Inference

    May 12, 2026Alireza Nadali, Patrick Cooper, Ashutosh Trivedi +1Efficient Long-Context InferenceKv-Cache Management

  27. Navigating LLM Valley: From AdamW to Memory-Efficient and Matrix-Based Optimizers

    May 9, 2026Aditya RanganathOptimizer DesignLarge Language Model Training

  28. Effective and Memory-Efficient Alternatives to ECC for Reliable Large-Scale DNNs

    May 8, 2026Mohammad Hasan Ahmadilivani, Marten Roots, Marco Restifo +3Error CorrectionNeural Network Inference

  29. Nearly Optimal Attention Coresets

    May 7, 2026Edo Liberty, Alexandr Andoni, Eldar KleinerGeometry-Aware Uncertainty CoresetsBounded-Memory

  30. The Impossibility Triangle of Long-Context Modeling

    May 6, 2026Yan ZhouSequence ModelingBounded-Memory

  31. Budget-aware Auto Optimizer Configurator

    May 6, 2026Kang Liu, Wei Peng, Jianchen HuOptimizer DesignGraphics Processing Unit Memory

  32. Memory-Efficient Continual Learning with CLIP Models

    May 5, 2026Ryan King, Gang Li, Bobak Mortazavi +1Contrastive Language-Image Pre-Training ModelReplay-Based Continual Learning

  33. Activation Compression in LLMs: Theoretical Analysis and Efficient Algorithm

    May 2, 2026Wen-Da Wei, Han-Bin Fang, Yang-Di Liu +3Large Language Model CompressionTask-Aware Compression

  34. Syntactically-guided Information Maintenance in Sentence Comprehension

    Apr 30, 2026Shinnosuke Isono, Kohei KajikawaSyntactic StructureBounded-Memory

  35. Onyx: Cost-Efficient Disk-Oblivious ANN Search

    Apr 22, 2026Deevashwer Rathee, Jean-Luc Watson, Zirui Neil Zhao +2Approximate Nearest-Neighbor SearchNeural Architecture Search

  36. RELOAD: A Robust and Efficient Learned Query Optimizer for Database Systems

    Apr 16, 2026Seokwon Lee, Jaeyoung Sim, Sihyun Kim +3Prompt OptimizationQueries

  37. Rheos: Modelling Continuous Motion Dynamics in Hierarchical 3D Scene Graphs

    Mar 9, 2026Iacopo Catalano, Francesco Verdoja, Javier Civera +23D Scene GraphsMotion Model

  38. ButterflyMoE: Compression-Scalable Ternary Experts via Structured Butterfly Orbits

    Jan 20, 2026Aryan KarmoreExpertsBounded-Memory