Cache

Momentum

31 papers in the last four weeks, up 94% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 196

All topics
CardsList
  1. FreqCache: Accelerating Embodied VLN Models with Adaptive Frequency-Guided Token Caching

    Apr 27, 2026Zihao Zheng, Xingyue Zhou, Zhihao Mao +7Vision-Language NavigationVision-Language Foundation Models

  2. AgenticCache: Cache-Driven Asynchronous Planning for Embodied AI Agents

    Apr 27, 2026Hojoon Kim, Yuheng Wu, Thierry TambeLarge Language Model PlanningEmbodied Agents

  3. MTServe: Efficient Serving for Generative Recommendation Models with Hierarchical Caches

    Apr 24, 2026Xin Wang, Chi Ma, Shaobin Chen +14Sequential RecommendationGraphics Processing Unit Memory

  4. Sub-Token Routing for KV Cache Compression

    Apr 23, 2026Wei Jiang, Wei WangKey-Value Cache CompressionToken Compression

  5. FlashFPS: Efficient Farthest Point Sampling for Large-Scale Point Clouds via Pruning and Caching

    Apr 20, 2026Yuzhe Fu, Hancheng Ye, Cong Guo +7Point CloudsCache

  6. StreamCacheVGGT: Streaming Visual Geometry Transformers with Robust Scoring and Hybrid Cache Compression

    Apr 16, 2026Xuanyi Liu, Chunan Yu, Deyi Ji +6Visual Geometry Grounded TransformerCache

  7. IE as Cache: Information Extraction Enhanced Agentic Reasoning

    Apr 16, 2026Hang Lv, Sheng Liang, Hongchao Gu +5Agentic ReasoningInformation Extraction

  8. KV Cache Offloading for Context-Intensive Tasks

    Apr 9, 2026Andrey Bocharnikov, Ivan Ermakov, Denis Kuznedelev +2Kv-Cache ManagementEfficient Long-Context Inference

  9. Adaptive Spectral Feature Forecasting for Diffusion Sampling Acceleration

    Mar 2, 2026Jiaqi Han, Juntong Shi, Puheng Li +3Diffusion SamplingDiffusion Transformers

  10. SenCache: Accelerating Diffusion Model Inference via Sensitivity-Aware Caching

    Feb 27, 2026Yasaman Haghighi, Alexandre AlahiDiffusion ModelsCache

  11. Learning to Evict from Key-Value Cache

    Feb 10, 2026Luca Moschella, Laura Manduchi, Ozan SenerKey-Value Cache EvictionKey-Value Cache

  12. ResidualKV: Residual-Based KV Cache Compression for Efficient Long-Context Inference

    Feb 8, 2026Jitai Hao, Qiang Huang, Yaowei Wang +2Efficient Long-Context InferenceKey-Value Cache Compression

  13. CORE-T: COherent REtrieval of Tables for Text-to-SQL

    Jan 19, 2026Hassan Soliman, Vivek Gupta, Dan Roth +1Text-To-SqlTabular Data