Diffusion Model Caching

Latest papers 72

All topics
CardsList
  1. Training Hybrid Block Diffusion Language Models with Partial Bidirectionality

    Jul 2, 2026Pranshu Chaturvedi, Parth Shroff, Tarun Suresh +2MambaLong-Context Language Model Inference

  2. Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding

    Jul 2, 2026Marianne Arriola, Volodymyr KuleshovLanguage Model DecodingDiffusion Language Model Decoding

  3. OTCache: Optimal Transport for Geometry-Aware Caching in Diffusion Models

    Jun 30, 2026Huanlin Gao, Fang Zhao, Qiang Hui +8Diffusion SamplingDiffusion Model Caching

  4. SyncCache: Exploiting Asymmetric Dynamics for Fast Audio-Driven Portrait Animation

    Jun 29, 2026Juncheng Ma, Yuxuan Du, Yanan Sun +8Diffusion TransformerAudio-Driven Facial Animation

  5. Affix Cache for Diffusion Large Language Models

    Jun 26, 2026Kaihua Liang, An Zhong, Xin Tan +4KV CachingMemory-Efficient Inference

  6. Bifocal Diffusion Language Models: Asymmetric Bidirectional Context for Parallel Generation

    Jun 26, 2026Yuhang Chen, Xianfeng Wu, Jinhao Duan +11Diffusion Language Model InferenceParallel Decoding

  7. NaviCache: Test-Time Self-Calibration Caching for Video Generation

    Jun 25, 2026Zheqi Lv, Zhibo Zhu, Jinke Wang +6Video Diffusion ModelsDiffusion Model Caching

  8. LearniBridge: Learnable Calibration of Feature Caching for Diffusion Models Acceleration

    Jun 25, 2026Xuyue Huang, Zhe Chen, Wang Shen +1Video Diffusion ModelsDiffusion Transformer

  9. MoECa: Aligning Feature Reuse with Expert Decomposition in Diffusion Transformers

    Jun 14, 2026Maoliang Li, Haojing Chen, Jiayu Chen +4Diffusion TransformerDiffusion Model Caching

  10. Budget-Constrained Step-Level Diffusion Caching

    Jun 11, 2026Mingkun Lei, Tong Zhao, Liangyu Yuan +1Diffusion Model CachingDiffusion Model Inference Acceleration

  11. FadeMem: Distance-Aware Memory Consolidation for Autoregressive Video Diffusion

    Jun 9, 2026Yu Lu, Junjie Yang, Piotr Koniusz +2KV CachingLong-Horizon Video Generation

  12. ReCache: Learning Budget-Aware Caching Schedules for Diffusion Models via REINFORCE

    Jun 4, 2026Mishan Aliev, Eva Neudachina, Ilya Bykov +4Diffusion Model CachingDiffusion Model Inference Acceleration

  13. WaveFilter: Enhancing the Long-Context Capability of Diffusion LLMs via Wavelet-Guided KV Cache Filtering

    May 30, 2026Jinnan Yang, Yan Wang, Zhen Bi +5Long-Context Language Model InferenceDiffusion Language Model Inference

  14. VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion

    May 28, 2026Hidir Yesiltepe, Jiazhen Hu, Tuna Han Salih Meral +4Video Diffusion ModelsSelf-Attention

  15. SoftCap: Soft-Budget Control for Diffusion Transformer Acceleration

    May 26, 2026Yuhang Zhang, Junxiang Qiu, Huixia Ben +3Diffusion TransformerDiffusion Model Caching

  16. Enabling KV Caching of Shared Prefix for Diffusion Language Models

    May 26, 2026Younghun Go, Jaehoon Han, Changyong Shin +2KV CachingKV-Cache Management

  17. Trajectory-Consistent Calibration for Cache-Accelerated Diffusion Models

    May 24, 2026Mingyu Liang, Dingkun Xu, Jingwei XuDiffusion TransformerDiffusion-Based Image Generation

  18. WorldKV: Efficient World Memory with World Retrieval and Compression

    May 21, 2026Jung Yi, Minjae Kim, Paul Hyunbin Cho +3KV CachingMemory-Augmented Video Generation

  19. Prefix-Adaptive Block Diffusion for Efficient Document Recognition

    May 16, 2026Mingxu Chai, Ziyu Shen, Chenyu Liu +9Diffusion Language Model InferenceDiffusion Model Caching

  20. Accelerating Rectified Flow Models via Trajectory-Aware Caching

    May 16, 2026Xiao Liu, Kai Liu, Naiyang Guan +5Video Diffusion ModelsRectified Flow

  21. Test-time Sparsity for Extreme Fast Action Diffusion

    May 13, 2026Kangye Ji, Yuan Meng, Jianbo Zhou +3Diffusion TransformerInference-Time Optimization

  22. Muninn: Your Trajectory Diffusion Model But Faster

    May 11, 2026Gokul Puthumanaillam, Hao Jiang, Ruben Hernandez +4Trajectory GenerationDiffusion-Based Planning

  23. SWIFT: Prompt-Adaptive Memory for Efficient Interactive Long Video Generation

    May 10, 2026Shanwen Tan, Hao Li, Jingtao Zhang +4Long Video GenerationMemory-Augmented Video Generation

  24. FlashClear: Ultra-Fast Image Content Removal via Efficient Step Distillation and Feature Caching

    May 9, 2026Yixin Tang, Jiawei Guo, Junxian Li +6Diffusion Model DistillationFew-Step Diffusion Sampling