Diffusion Model Inference Acceleration

Latest papers 335

All topics
CardsList
  1. Dynamic-in-Few-Step: Unifying Dynamic Computation and Few-Step Distillation for Efficient Video Generation

    Jul 7, 2026Yu Cheng, Siyue Yao, Zhongang Qi +3Video Diffusion ModelsDiffusion Model Distillation

  2. MobileWan: Closing the Quality Gap for Mobile Video Diffusion

    Jul 7, 2026Mohsen Ghafoorian, Denis Korzhenkov, Adil Karjauv +9Video Diffusion ModelsVideo Generation

  3. x-Prediction Is All You Need:Training-Free Accelerated Generation via Endpoint Decodability

    Jul 7, 2026Xin Peng, Ang GaoDiffusion SamplingFew-Step Diffusion Sampling

  4. Flash-BoN: Instant Drafts for Inference-Time Scaling in Diffusion Models

    Jul 5, 2026Ruchit Rawal, Reza Shirkavand, Sayak Paul +5Inference-Time ScalingBest-of-N Sampling

  5. EMPURPLE: A Free Lunch for Diffusion Distillation based on the Information Bottleneck

    Jul 5, 2026Zilai Li, Lujia BaiDistribution ShiftDiffusion Model Distillation

  6. Flex-Forcing: Towards a Unified Autoregressive and Bidirectional Video Diffusion Model

    Jul 3, 2026Xinyin Ma, Julius Berner, Chao Liu +3Video Diffusion ModelsAutoregressive Diffusion

  7. TACG: Trajectory-Aware Commit Gating for Diffusion Language Model Decoding

    Jul 3, 2026Chengcheng Wang, Tingzhang Luo, Wenhao Li +2Diffusion Language Model InferenceDiffusion Language Model Decoding

  8. Set Diffusion: Interpolating Token Orderings Between Autoregression and Diffusion for Fast and Flexible Decoding

    Jul 2, 2026Marianne Arriola, Volodymyr KuleshovLanguage Model DecodingDiffusion Language Model Decoding

  9. Multi-Resolution Flow Matching: Training-Free Diffusion Acceleration via Staged Sampling

    Jul 2, 2026Xingyu Zheng, Xianglong Liu, Yifu Ding +4Diffusion Model AccelerationDiffusion Model Inference Acceleration

  10. Accelerating Discrete Diffusion Models with Parallel-In-Time Sampling

    Jul 1, 2026Yu Yao, Huanjian Zhou, Andi Han +2Diffusion SamplingDiffusion Model Inference Acceleration

  11. Cross-Space Distillation: Teaching One-Step Students with Modern Diffusion Teachers

    Jun 30, 2026Anh Nguyen, Ngan Nguyen, Duc Vu +11Diffusion Model DistillationCross-Architecture Knowledge Distillation

  12. OTCache: Optimal Transport for Geometry-Aware Caching in Diffusion Models

    Jun 30, 2026Huanlin Gao, Fang Zhao, Qiang Hui +8Diffusion SamplingDiffusion Model Caching

  13. SyncCache: Exploiting Asymmetric Dynamics for Fast Audio-Driven Portrait Animation

    Jun 29, 2026Juncheng Ma, Yuxuan Du, Yanan Sun +8Diffusion TransformerAudio-Driven Facial Animation

  14. SAFE-DiT: Semantics-Aware Fast-path Execution for High-Resolution Diffusion Transformers

    Jun 28, 2026Xuanhua Yin, Yuxuan Jia, Chuanzhi Xu +1Diffusion TransformerDiffusion Model Inference Acceleration

  15. Multi-Block Diffusion Language Models

    Jun 28, 2026Yijie Jin, Jiajun Xu, Yuxuan Liu +8Blockwise Diffusion Language ModelsDiffusion Language Model Decoding

  16. Masked Diffusion Decoding as xx-Prediction Flow

    Jun 27, 2026Weitian Wang, Lianlei Shan, Shubham Rai +2Masked Diffusion ModelsDiffusion Language Model Decoding

  17. SATB-VR: Training Few-Step Video Restoration Diffusion Model using SNR-Aware Trajectory Blending

    Jun 27, 2026Haoran Bai, Xiaoxu Chen, Xiaoyu Liu +4Video Diffusion ModelsFew-Step Diffusion Sampling

  18. Focusing on What Matters: Saliency-Harnessing Accurate Routing for Diffusion MoE

    Jun 25, 2026Haoyou Deng, Keyu Yan, Chaojie Mao +4Expert RoutingDiffusion-Based Image Generation

  19. NaviCache: Test-Time Self-Calibration Caching for Video Generation

    Jun 25, 2026Zheqi Lv, Zhibo Zhu, Jinke Wang +6Video Diffusion ModelsDiffusion Model Caching

  20. LearniBridge: Learnable Calibration of Feature Caching for Diffusion Models Acceleration

    Jun 25, 2026Xuyue Huang, Zhe Chen, Wang Shen +1Video Diffusion ModelsDiffusion Transformer

  21. Retrieval-Warmed Energy-Based Reasoning: A Five-Arm Ablation Methodology for Diffusion-as-Inference on Structured Reasoning Tasks

    Jun 25, 2026Libo Sun, Po-Wei Harn, Zewei Zhang +2Diffusion SamplingEnergy-Based Models

  22. Chorus II: Cross-Request Sparsity Reuse for Efficient Image-to-Video Generation

    Jun 23, 2026Hao Liu, Chenghuan Huang, Hao Liu +6Image-to-Video GenerationVideo Diffusion Models

  23. Keep The Essentials: Efficient Reference Conditioned Generation via Token Dropping

    Jun 22, 2026Rishubh Parihar, Ayush Raina, R. Venkatesh Babu +1Conditional Image GenerationDiffusion Model Fine-Tuning

  24. ScalingAttention: Discovering Intrinsic Sparse Attention Topology for Video Diffusion Transformers

    Jun 22, 2026Ruiliang Zhou, Xuecheng Wu, Kang He +6Video Diffusion ModelsDiffusion Transformer