Diffusion Model Caching

Latest papers 69

All topics
CardsList
  1. MC-Sparse: Deconstructing and Closing the Dense-Sparse Attention Gap in Diffusion Transformers

    Oct 5, 2026Jiarui Chen, Zeqiang Lai, Jiangshan Wang +5Video Diffusion ModelsDiffusion Transformer

  2. Hybrid-Basis Feature Forecasting for Diffusion Sampling Acceleration

    Oct 4, 2026Kai-Liang Cheng, Yuan-Yuan Cheng, Yu-fan Jin +1Diffusion SamplingDiffusion Model Caching

  3. The Golden Path Hypothesis: Reusable Schedules in Diffusion Caching

    Sep 30, 2026Dong Wang, Wenwu Tang, Francesco Corti +3Diffusion Model CachingDiffusion Timestep Scheduling

  4. RA-CFGCache: From Branch-Level Criteria to Guided-Risk Control under Classifier-Free Guidance

    Sep 29, 2026Yiming Liu, Ben Wan, Tongxuan Liu +5Classifier-Free GuidanceDiffusion Model Caching

  5. In-Flight KV Cache with Clean Anchors for Faster Autoregressive Video Diffusion

    Sep 26, 2026Yikai Wang, Xiao Han, Mengmeng Xu +9Long-Horizon Video GenerationDiffusion Model Caching

  6. Fixed State, Long Reach: What a Constant-Size Cache Buys Block Diffusion at Scale

    Sep 14, 2026Vaibhav Singh, Pierre-André Noël, Torsten Scholak +2Blockwise Diffusion Language ModelsDiffusion Language Model Inference

  7. RegionCache: Semantic-Aware Region Reuse for Efficient Multi-Turn Image Generation

    Aug 30, 2026Peizheng Li, Xin Ai, Hanyuan Liu +2Diffusion Model CachingDiffusion-Based Image Editing

  8. Beyond Attention Masks: Instruction Anchoring for Efficient In-Context Diffusion Generation

    Aug 21, 2026Yangshuai Liu, Zheming Li, Jiaao Li +4Diffusion TransformerDiffusion Model Caching

  9. From Local Mismatch to Global Impact: Optimizing Cache Reuse Policy for Efficient Diffusion

    Aug 13, 2026Xichen Ye, Yifan Wu, Zhikang Xie +3Video Diffusion ModelsDiffusion-Based Image Generation

  10. BAG: Budget-Aware Gating for Diffusion Caching

    Aug 10, 2026Tong Zhao, Mingkun Lei, Yucheng Han +1Diffusion TransformerDiffusion Model Caching

  11. Archer: Adaptive Reuse of Cached Hidden States for Efficient Rollback in Diffusion Language Models

    Aug 8, 2026Xuning He, Zinan Sheng, Yongding Tao +4Diffusion Language Model InferenceDiffusion Model Caching

  12. BRACE: Taming Sharp Irregularities via Barycentric Rational Forecasting for Fast Diffusion Transformers Inference

    Aug 4, 2026Jinlong Yang, Jinke Wu, Lizilin +1Diffusion TransformerDiffusion Model Caching

  13. EchoCache: Energy-Guided Cross-Modal Caching for Efficient Audio-Driven Video Generation

    Aug 3, 2026Jiayu Chen, Xiaoyu Wu, Rongshan Gao +6Audio-Video GenerationAudio-Visual Alignment

  14. Disagree to Accelerate: Closing the Loop on Diffusion Feature Forecasts

    Aug 3, 2026Yanchao Li, Jiaqing Xie, Ben Gao +6Diffusion SamplingDiffusion Model Caching

  15. OnlineCache: Learning Dynamic Caching Policies with Error Correction for Efficient Diffusion Inference

    Jul 31, 2026Zhikang Xie, Xichen Ye, Yifan Wu +5Diffusion Model CachingDiffusion Model Inference Acceleration

  16. FeatFix: Reuse What You Verify through Local Exact-Feature Correction for Faster Cached Diffusion Inference

    Jul 30, 2026Hanshuai Cui, Zhiqing Tang, Zhi Yao +3Diffusion-Based Image GenerationDiffusion Model Caching

  17. OmniCache: Multidimensional Hierarchical Feature Caching For Diffusion Models

    Jul 26, 2026Zhaoyuan He, Muhammad Muaz, Lili QiuVideo Diffusion ModelsDiffusion Transformer

  18. CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion

    Jul 25, 2026Shreshth Saini, Neil Birkbeck, Yilin Wang +2Video Diffusion ModelsVideo Generation

  19. Evolving Cache Schedules for Fast Diffusion Policy Inference

    Jul 22, 2026Siying Wang, Kangye Ji, Di Wang +1Diffusion PolicyDiffusion Model Caching

  20. DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse

    Jul 17, 2026Yuyang Chen, Runxin Zhong, Zan Zong +3Diffusion TransformerEfficient Attention

  21. ACID: Adaptive Caching for vIDeo generation

    Jul 14, 2026Om Agrawal, Saurabh Agarwal, Aditya AkellaVideo Diffusion ModelsDiffusion Model Caching

  22. Training Hybrid Block Diffusion Language Models with Partial Bidirectionality

    Jul 2, 2026Pranshu Chaturvedi, Parth Shroff, Tarun Suresh +2MambaLong-Context Language Model Inference

  23. Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding

    Jul 2, 2026Marianne Arriola, Volodymyr KuleshovLanguage Model DecodingDiffusion Language Model Decoding

  24. OTCache: Optimal Transport for Geometry-Aware Caching in Diffusion Models

    Jun 30, 2026Huanlin Gao, Fang Zhao, Qiang Hui +8Diffusion SamplingDiffusion Model Caching

  25. SyncCache: Exploiting Asymmetric Dynamics for Fast Audio-Driven Portrait Animation

    Jun 29, 2026Juncheng Ma, Yuxuan Du, Yanan Sun +8Diffusion TransformerAudio-Driven Facial Animation

  26. Affix Cache for Diffusion Large Language Models

    Jun 26, 2026Kaihua Liang, An Zhong, Xin Tan +4KV CachingMemory-Efficient Inference

  27. Bifocal Diffusion Language Models: Asymmetric Bidirectional Context for Parallel Generation

    Jun 26, 2026Yuhang Chen, Xianfeng Wu, Jinhao Duan +11Diffusion Language Model InferenceParallel Decoding

  28. NaviCache: Test-Time Self-Calibration Caching for Video Generation

    Jun 25, 2026Zheqi Lv, Zhibo Zhu, Jinke Wang +6Video Diffusion ModelsDiffusion Model Caching

  29. LearniBridge: Learnable Calibration of Feature Caching for Diffusion Models Acceleration

    Jun 25, 2026Xuyue Huang, Zhe Chen, Wang Shen +1Video Diffusion ModelsDiffusion Transformer

  30. MoECa: Aligning Feature Reuse with Expert Decomposition in Diffusion Transformers

    Jun 14, 2026Maoliang Li, Haojing Chen, Jiayu Chen +4Diffusion TransformerDiffusion Model Caching

  31. Budget-Constrained Step-Level Diffusion Caching

    Jun 11, 2026Mingkun Lei, Tong Zhao, Liangyu Yuan +1Diffusion Model CachingDiffusion Model Inference Acceleration

  32. FadeMem: Distance-Aware Memory Consolidation for Autoregressive Video Diffusion

    Jun 9, 2026Yu Lu, Junjie Yang, Piotr Koniusz +2KV CachingLong-Horizon Video Generation

  33. ReCache: Learning Budget-Aware Caching Schedules for Diffusion Models via REINFORCE

    Jun 4, 2026Mishan Aliev, Eva Neudachina, Ilya Bykov +4Diffusion Model CachingDiffusion Model Inference Acceleration

  34. WaveFilter: Enhancing the Long-Context Capability of Diffusion LLMs via Wavelet-Guided KV Cache Filtering

    May 30, 2026Jinnan Yang, Yan Wang, Zhen Bi +5Long-Context Language Model InferenceDiffusion Language Model Inference

  35. VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion

    May 28, 2026Hidir Yesiltepe, Jiazhen Hu, Tuna Han Salih Meral +4Video Diffusion ModelsSelf-Attention

  36. SoftCap: Soft-Budget Control for Diffusion Transformer Acceleration

    May 26, 2026Yuhang Zhang, Junxiang Qiu, Huixia Ben +3Diffusion TransformerDiffusion Model Caching

  37. Enabling KV Caching of Shared Prefix for Diffusion Language Models

    May 26, 2026Younghun Go, Jaehoon Han, Changyong Shin +2KV CachingKV-Cache Management

  38. Trajectory-Consistent Calibration for Cache-Accelerated Diffusion Models

    May 24, 2026Mingyu Liang, Dingkun Xu, Jingwei XuDiffusion TransformerDiffusion-Based Image Generation

  39. WorldKV: Efficient World Memory with World Retrieval and Compression

    May 21, 2026Jung Yi, Minjae Kim, Paul Hyunbin Cho +3KV CachingMemory-Augmented Video Generation

  40. Prefix-Adaptive Block Diffusion for Efficient Document Recognition

    May 16, 2026Mingxu Chai, Ziyu Shen, Chenyu Liu +9Diffusion Language Model InferenceDiffusion Model Caching

  41. Accelerating Rectified Flow Models via Trajectory-Aware Caching

    May 16, 2026Xiao Liu, Kai Liu, Naiyang Guan +5Video Diffusion ModelsRectified Flow

  42. Test-time Sparsity for Extreme Fast Action Diffusion

    May 13, 2026Kangye Ji, Yuan Meng, Jianbo Zhou +3Diffusion TransformerInference-Time Optimization

  43. Muninn: Your Trajectory Diffusion Model But Faster

    May 11, 2026Gokul Puthumanaillam, Hao Jiang, Ruben Hernandez +4Trajectory GenerationDiffusion-Based Planning

  44. SWIFT: Prompt-Adaptive Memory for Efficient Interactive Long Video Generation

    May 10, 2026Shanwen Tan, Hao Li, Jingtao Zhang +4Long Video GenerationMemory-Augmented Video Generation

  45. FlashClear: Ultra-Fast Image Content Removal via Efficient Step Distillation and Feature Caching

    May 9, 2026Yixin Tang, Jiawei Guo, Junxian Li +6Diffusion Model DistillationFew-Step Diffusion Sampling

  46. Motion-Aware Caching for Efficient Autoregressive Video Generation

    May 3, 2026Jing Xu, Yuexiao Ma, Xuzhe Zheng +7Video Diffusion ModelsKV-Cache Management

  47. DARE: Diffusion Language Model Activation Reuse for Efficient Inference

    May 1, 2026Natalia Frumkin, Bokun Wang, Hung-Yueh Chiang +3Self-AttentionDiffusion Language Model Inference

  48. Beyond Fixed Formulas: Data-Driven Linear Predictor for Efficient Diffusion Models

    Apr 29, 2026Zhirong Shen, Rui Huang, Jiacheng Liu +6Diffusion TransformerDiffusion Model Caching