Diffusion Model Inference Acceleration

Latest papers 335

All topics
CardsList
  1. DAVET: Denoising-Aware Visual Evidence Trajectory Allocation for Diffusion Vision-Language Models

    Aug 3, 2026Yongkang Zhou, Xiang Xia, Cheng Yan +2Vision-Language ModelsEfficient VLM Inference

  2. REFLEX: Rethinking MoE Inference as Refinement-Aware Compute Allocation in Diffusion Language Models

    Aug 3, 2026Xiang Xia, Cheng Yan, Yiming Zhang +3Expert Load BalancingMixture-of-Experts Inference

  3. Disagree to Accelerate: Closing the Loop on Diffusion Feature Forecasts

    Aug 3, 2026Yanchao Li, Jiaqing Xie, Ben Gao +6Diffusion SamplingDiffusion Model Caching

  4. TurboClear: One-Step Object-Effect Removal via Region-Calibrated Distribution Matching and Fusion

    Aug 2, 2026Jiawei Guo, Junxian Li, Yixin Tang +4Diffusion Model DistillationDiffusion-Based Image Editing

  5. DeltaFlow: Noise-Adaptive Bidirectional Gated Delta Networks for Embedded Language Flows

    Aug 2, 2026Guangfu Guo, Xiaoqian Lu, Linsey Pang +4Gated Delta NetworksDiffusion Language Models

  6. DiffusionGemma Technical Report

    Jul 31, 2026DiffusionGemma Team, Adrien Ali Taïga, James Assiene +41Blockwise Diffusion Language ModelsDiffusion Model Fine-Tuning

  7. OnlineCache: Learning Dynamic Caching Policies with Error Correction for Efficient Diffusion Inference

    Jul 31, 2026Zhikang Xie, Xichen Ye, Yifan Wu +5Diffusion Model CachingDiffusion Model Inference Acceleration

  8. FA-RDP: A Frequency-Adaptive Reactive Diffusion Policy for Contact-Rich Manipulation

    Jul 30, 2026Lifeng Zhuo, Wendi Chen, Han Xue +4Contact-Rich Robotic ManipulationVisuomotor Policy Learning

  9. FeatFix: Reuse What You Verify through Local Exact-Feature Correction for Faster Cached Diffusion Inference

    Jul 30, 2026Hanshuai Cui, Zhiqing Tang, Zhi Yao +3Diffusion-Based Image GenerationDiffusion Model Caching

  10. FARI: Robust One-Step Inversion for Watermarking in Diffusion Models

    Jul 29, 2026Jindong Yang, Han Fang, Weiming Zhang +2Diffusion Model InversionDiffusion Model Watermarking

  11. Noise-Free One-Step LoRA for Task-Driven Image Restoration with Diffusion Priors

    Jul 28, 2026Jaeha Kim, Kyoung Mu LeeDiffusion Models for Image RestorationLow-Rank Adaptation

  12. OmniCache: Multidimensional Hierarchical Feature Caching For Diffusion Models

    Jul 26, 2026Zhaoyuan He, Muhammad Muaz, Lili QiuVideo Diffusion ModelsDiffusion Transformer

  13. TRaM-VSR: Importance-Aware Token Routing and Merging for One-Step Diffusion Video Super-Resolution

    Jul 24, 2026Sicheng Gao, Zhuyun Zhou, Yixuan Liu +3Diffusion TransformerVideo Super-Resolution

  14. Neuromorphic Diffusion Language Models: Addressing Compute and Memory Bottlenecks via Sparsity and Block Denoising

    Jul 24, 2026Dengyu Wu, Clement Ruah, Jiechen Chen +2Diffusion Language Model DecodingNeuromorphic Computing

  15. Ms. Forcing: Efficient Streaming Video Generation with Multi-Scale Patchification and Attention

    Jul 23, 2026Zekun Li, Xiaoyan Cong, Hongyu Li +5Video Diffusion ModelsLong-Horizon Video Generation

  16. Evolving Cache Schedules for Fast Diffusion Policy Inference

    Jul 22, 2026Siying Wang, Kangye Ji, Di Wang +1Diffusion PolicyDiffusion Model Caching

  17. HeadCast: Casting Attention Heads for Efficient Autoregressive Video Generation

    Jul 22, 2026Jinliang Shen, Lianghao Su, Zheming Li +4KV-Cache ManagementAutoregressive Video Generation

  18. Speculative Correction: Draft-then-Refine Decoding for Diffusion Language Models

    Jul 21, 2026Brian K Chen, Chong Wu, Kenji KawaguchiLanguage Model DecodingSpeculative Decoding for Diffusion Language Models

  19. FlowBlock: Wavefront-Parallel Decoding for Self-Correcting Diffusion Language Models

    Jul 20, 2026Bing Tian, Haikun Liu, Xiaocheng Zhong +5Blockwise Diffusion Language ModelsParallel Decoding

  20. FVAttn: Adaptive Sparse Attention with Runtime Load Balancing for Video Generation

    Jul 17, 2026Hao Liu, Chenghuan Huang, Ye Huang +7Video Diffusion ModelsDiffusion Transformer

  21. Adaptive Multi-Step Lookahead Decoding for Diffusion Language Models

    Jul 17, 2026Yingqian Cui, Wei Deng, Lantao Mei +4Masked Diffusion ModelsLanguage Model Decoding

  22. DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse

    Jul 17, 2026Yuyang Chen, Runxin Zhong, Zan Zong +3Diffusion TransformerEfficient Attention

  23. Kaleido: Algorithm-Hardware Co-Design for Video Diffusion Transformers by Exploiting Latent Space Correlations

    Jul 15, 2026Wenxuan Miao, Haosong Liu, Weiming Hu +9Video Diffusion ModelsDiffusion Transformer

  24. ACID: Adaptive Caching for vIDeo generation

    Jul 14, 2026Om Agrawal, Saurabh Agarwal, Aditya AkellaVideo Diffusion ModelsDiffusion Model Caching

  25. Reducing Temporal Redundancy for Efficient Vision-Language-Action Inference

    Jul 14, 2026Yuzhou Wu, Yuxin Zheng, Muchun Niu +6Efficient VLA Model InferenceEfficient VLA Models

  26. FlashDiff: Efficient Regional Execution and Scheduling for Diffusion Model Serving

    Jul 13, 2026Yaqi Qiao, Ping He, Songrun Xie +4Diffusion Model ServingDiffusion Model Inference Acceleration

  27. Bridging Diffusion Pruning and Step Distillation with Teacher-Aligned Repair

    Jul 7, 2026Jincheng Ying, Li Wenlin, Minghui Xu +1Diffusion Model DistillationFew-Step Diffusion Sampling