Diffusion Model Caching

Latest papers 72

All topics
CardsList
  1. MORCA: Offline-to-Online Reinforcement Learning for Adaptive Cache Reuse in Video Diffusion Acceleration

    Oct 7, 2026Yuxiang Xiong, Ruiyan Wang, Wenqiang Wang +5Diffusion Model CachingDiffusion Model Inference Acceleration

  2. Koopman Observers for Diffusion Acceleration: Correcting Feature Forecasts with Shallow Measurements

    Oct 7, 2026Hanru Bai, Yuanchao Xu, Fengyi LiDiffusion Model Inference AccelerationDiffusion Model Caching

  3. MC-Sparse: Deconstructing and Closing the Dense-Sparse Attention Gap in Diffusion Transformers

    Oct 5, 2026Jiarui Chen, Zeqiang Lai, Jiangshan Wang +5Video Diffusion ModelsDiffusion Transformer

  4. Hybrid-Basis Feature Forecasting for Diffusion Sampling Acceleration

    Oct 4, 2026Kai-Liang Cheng, Yuan-Yuan Cheng, Yu-fan Jin +1Diffusion SamplingDiffusion Model Caching

  5. In-Distribution Forcing for Long Video Generation at Test Time

    Oct 2, 2026Jeongwoo Shin, Youngyoon Choi, Sangwoo Jo +5Long Video GenerationVideo Diffusion Models

  6. The Golden Path Hypothesis: Reusable Schedules in Diffusion Caching

    Sep 30, 2026Dong Wang, Wenwu Tang, Francesco Corti +3Diffusion Model CachingDiffusion Timestep Scheduling

  7. RA-CFGCache: From Branch-Level Criteria to Guided-Risk Control under Classifier-Free Guidance

    Sep 29, 2026Yiming Liu, Ben Wan, Tongxuan Liu +5Classifier-Free GuidanceDiffusion Model Caching

  8. In-Flight KV Cache with Clean Anchors for Faster Autoregressive Video Diffusion

    Sep 26, 2026Yikai Wang, Xiao Han, Mengmeng Xu +9Long-Horizon Video GenerationDiffusion Model Caching

  9. Fixed State, Long Reach: What a Constant-Size Cache Buys Block Diffusion at Scale

    Sep 14, 2026Vaibhav Singh, Pierre-André Noël, Torsten Scholak +2Blockwise Diffusion Language ModelsDiffusion Language Model Inference

  10. RegionCache: Semantic-Aware Region Reuse for Efficient Multi-Turn Image Generation

    Aug 30, 2026Peizheng Li, Xin Ai, Hanyuan Liu +2Diffusion Model CachingDiffusion-Based Image Editing

  11. Beyond Attention Masks: Instruction Anchoring for Efficient In-Context Diffusion Generation

    Aug 21, 2026Yangshuai Liu, Zheming Li, Jiaao Li +4Diffusion TransformerDiffusion Model Caching

  12. From Local Mismatch to Global Impact: Optimizing Cache Reuse Policy for Efficient Diffusion

    Aug 13, 2026Xichen Ye, Yifan Wu, Zhikang Xie +3Video Diffusion ModelsDiffusion-Based Image Generation

  13. BAG: Budget-Aware Gating for Diffusion Caching

    Aug 10, 2026Tong Zhao, Mingkun Lei, Yucheng Han +1Diffusion TransformerDiffusion Model Caching

  14. Archer: Adaptive Reuse of Cached Hidden States for Efficient Rollback in Diffusion Language Models

    Aug 8, 2026Xuning He, Zinan Sheng, Yongding Tao +4Diffusion Language Model InferenceDiffusion Model Caching

  15. BRACE: Taming Sharp Irregularities via Barycentric Rational Forecasting for Fast Diffusion Transformers Inference

    Aug 4, 2026Jinlong Yang, Jinke Wu, Lizilin +1Diffusion TransformerDiffusion Model Caching

  16. EchoCache: Energy-Guided Cross-Modal Caching for Efficient Audio-Driven Video Generation

    Aug 3, 2026Jiayu Chen, Xiaoyu Wu, Rongshan Gao +6Audio-Video GenerationAudio-Visual Alignment

  17. Disagree to Accelerate: Closing the Loop on Diffusion Feature Forecasts

    Aug 3, 2026Yanchao Li, Jiaqing Xie, Ben Gao +6Diffusion SamplingDiffusion Model Caching

  18. OnlineCache: Learning Dynamic Caching Policies with Error Correction for Efficient Diffusion Inference

    Jul 31, 2026Zhikang Xie, Xichen Ye, Yifan Wu +5Diffusion Model CachingDiffusion Model Inference Acceleration

  19. FeatFix: Reuse What You Verify through Local Exact-Feature Correction for Faster Cached Diffusion Inference

    Jul 30, 2026Hanshuai Cui, Zhiqing Tang, Zhi Yao +3Diffusion-Based Image GenerationDiffusion Model Caching

  20. OmniCache: Multidimensional Hierarchical Feature Caching For Diffusion Models

    Jul 26, 2026Zhaoyuan He, Muhammad Muaz, Lili QiuVideo Diffusion ModelsDiffusion Transformer

  21. CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion

    Jul 25, 2026Shreshth Saini, Neil Birkbeck, Yilin Wang +2Video Diffusion ModelsVideo Generation

  22. Evolving Cache Schedules for Fast Diffusion Policy Inference

    Jul 22, 2026Siying Wang, Kangye Ji, Di Wang +1Diffusion PolicyDiffusion Model Caching

  23. DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse

    Jul 17, 2026Yuyang Chen, Runxin Zhong, Zan Zong +3Diffusion TransformerEfficient Attention

  24. ACID: Adaptive Caching for vIDeo generation

    Jul 14, 2026Om Agrawal, Saurabh Agarwal, Aditya AkellaVideo Diffusion ModelsDiffusion Model Caching

  25. Training Hybrid Block Diffusion Language Models with Partial Bidirectionality

    Jul 2, 2026Pranshu Chaturvedi, Parth Shroff, Tarun Suresh +2MambaLong-Context Language Model Inference

  26. Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding

    Jul 2, 2026Marianne Arriola, Volodymyr KuleshovLanguage Model DecodingDiffusion Language Model Decoding

  27. OTCache: Optimal Transport for Geometry-Aware Caching in Diffusion Models

    Jun 30, 2026Huanlin Gao, Fang Zhao, Qiang Hui +8Diffusion SamplingDiffusion Model Caching

  28. SyncCache: Exploiting Asymmetric Dynamics for Fast Audio-Driven Portrait Animation

    Jun 29, 2026Juncheng Ma, Yuxuan Du, Yanan Sun +8Diffusion TransformerAudio-Driven Facial Animation

  29. Affix Cache for Diffusion Large Language Models

    Jun 26, 2026Kaihua Liang, An Zhong, Xin Tan +4KV CachingMemory-Efficient Inference

  30. Bifocal Diffusion Language Models: Asymmetric Bidirectional Context for Parallel Generation

    Jun 26, 2026Yuhang Chen, Xianfeng Wu, Jinhao Duan +11Diffusion Language Model InferenceParallel Decoding

  31. NaviCache: Test-Time Self-Calibration Caching for Video Generation

    Jun 25, 2026Zheqi Lv, Zhibo Zhu, Jinke Wang +6Video Diffusion ModelsDiffusion Model Caching

  32. LearniBridge: Learnable Calibration of Feature Caching for Diffusion Models Acceleration

    Jun 25, 2026Xuyue Huang, Zhe Chen, Wang Shen +1Video Diffusion ModelsDiffusion Transformer

  33. MoECa: Aligning Feature Reuse with Expert Decomposition in Diffusion Transformers

    Jun 14, 2026Maoliang Li, Haojing Chen, Jiayu Chen +4Diffusion TransformerDiffusion Model Caching

  34. Budget-Constrained Step-Level Diffusion Caching

    Jun 11, 2026Mingkun Lei, Tong Zhao, Liangyu Yuan +1Diffusion Model CachingDiffusion Model Inference Acceleration

  35. FadeMem: Distance-Aware Memory Consolidation for Autoregressive Video Diffusion

    Jun 9, 2026Yu Lu, Junjie Yang, Piotr Koniusz +2KV CachingLong-Horizon Video Generation

  36. ReCache: Learning Budget-Aware Caching Schedules for Diffusion Models via REINFORCE

    Jun 4, 2026Mishan Aliev, Eva Neudachina, Ilya Bykov +4Diffusion Model CachingDiffusion Model Inference Acceleration

  37. WaveFilter: Enhancing the Long-Context Capability of Diffusion LLMs via Wavelet-Guided KV Cache Filtering

    May 30, 2026Jinnan Yang, Yan Wang, Zhen Bi +5Long-Context Language Model InferenceDiffusion Language Model Inference

  38. VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion

    May 28, 2026Hidir Yesiltepe, Jiazhen Hu, Tuna Han Salih Meral +4Video Diffusion ModelsSelf-Attention

  39. SoftCap: Soft-Budget Control for Diffusion Transformer Acceleration

    May 26, 2026Yuhang Zhang, Junxiang Qiu, Huixia Ben +3Diffusion TransformerDiffusion Model Caching

  40. Enabling KV Caching of Shared Prefix for Diffusion Language Models

    May 26, 2026Younghun Go, Jaehoon Han, Changyong Shin +2KV CachingKV-Cache Management

  41. Trajectory-Consistent Calibration for Cache-Accelerated Diffusion Models

    May 24, 2026Mingyu Liang, Dingkun Xu, Jingwei XuDiffusion TransformerDiffusion-Based Image Generation

  42. WorldKV: Efficient World Memory with World Retrieval and Compression

    May 21, 2026Jung Yi, Minjae Kim, Paul Hyunbin Cho +3KV CachingMemory-Augmented Video Generation

  43. Prefix-Adaptive Block Diffusion for Efficient Document Recognition

    May 16, 2026Mingxu Chai, Ziyu Shen, Chenyu Liu +9Diffusion Language Model InferenceDiffusion Model Caching

  44. Accelerating Rectified Flow Models via Trajectory-Aware Caching

    May 16, 2026Xiao Liu, Kai Liu, Naiyang Guan +5Video Diffusion ModelsRectified Flow

  45. Test-time Sparsity for Extreme Fast Action Diffusion

    May 13, 2026Kangye Ji, Yuan Meng, Jianbo Zhou +3Diffusion TransformerInference-Time Optimization

  46. Muninn: Your Trajectory Diffusion Model But Faster

    May 11, 2026Gokul Puthumanaillam, Hao Jiang, Ruben Hernandez +4Trajectory GenerationDiffusion-Based Planning

  47. SWIFT: Prompt-Adaptive Memory for Efficient Interactive Long Video Generation

    May 10, 2026Shanwen Tan, Hao Li, Jingtao Zhang +4Long Video GenerationMemory-Augmented Video Generation

  48. FlashClear: Ultra-Fast Image Content Removal via Efficient Step Distillation and Feature Caching

    May 9, 2026Yixin Tang, Jiawei Guo, Junxian Li +6Diffusion Model DistillationFew-Step Diffusion Sampling