Diffusion Model Inference Acceleration

Latest papers 335

All topics
CardsList
  1. Mitigating the Contractivity Trap in Diffusion ODEs via Stein Stabilization

    Jun 5, 2026Shigui Li, Delu ZengFew-Step Diffusion SamplingDiffusion Model Inference Acceleration

  2. Tracing the Oracle: Improving Diffusion Timestep Scheduling for 3D CT Reconstruction

    Jun 4, 2026Yujia Wu, Zhaoqiang LiuDiffusion SamplingFew-Step Diffusion Sampling

  3. ReCache: Learning Budget-Aware Caching Schedules for Diffusion Models via REINFORCE

    Jun 4, 2026Mishan Aliev, Eva Neudachina, Ilya Bykov +4Diffusion Model CachingDiffusion Model Inference Acceleration

  4. Flash-WAM: Modality-Aware Distillation for World Action Models

    Jun 3, 2026Arman Akbari, Ci Zhang, Arash Akbari +6Video Diffusion ModelsAction-Conditioned World Models

  5. DSA: Dynamic Step Allocation for Fast Autoregressive Video Generation

    Jun 3, 2026Thanh-Tung Le, Yunhan Zhao, Menglei Chai +5Autoregressive DiffusionReal-Time Interactive Video Generation

  6. Supportive Token Revealing for Fast Diffusion Language Model Decoding

    Jun 2, 2026Giries Abu Ayoub, Mario Barbara, Lluís Pastor-Pérez +4Masked Diffusion ModelsDiffusion Language Model Decoding

  7. RMPrior: Bridging Propagation Priors and Diffusion Refinement for Efficient Radio Map Construction

    Jun 2, 2026Zixuan Guo, Xiucheng Wang, Nan ChengFew-Step Diffusion SamplingWireless Communications

  8. Fast-dLLM++: Fréchet Profile Decoding for Faster Diffusion LLM Inference

    Jun 1, 2026Siva Rajesh Kasa, Yasong Dai, Sumit Negi +1Language Model DecodingParallel Decoding

  9. FLARE: Diffusion for Hybrid Language Model

    Jun 1, 2026Yuchen Zhu, Jing Shi, Chongjian Ge +9Diffusion Model ServingDiffusion Language Model Inference

  10. GLIDE: Graph-guided Leap Inference for Diffusion Estimation of Spatio-Temporal Point Processes

    May 31, 2026Guanyu Zhou, Yao Liu, Yanglei Gan +5Event Time PredictionTemporal Point Processes

  11. TAPS: Target-Aware Prefix Tree Selection for Diffusion-Drafted Speculative Decoding

    May 30, 2026Zhuoyu Wang, Junnan Huang, Xinyu ChenTree SearchSpeculative Decoding

  12. LVSA: Training-Free Sparse Attention for Long Video Diffusion

    May 29, 2026Gael Glorian, Ioannis Lamprou, Zhen Zhang +2Video Diffusion ModelsLong-Horizon Video Generation

  13. Veda: Scalable Video Diffusion via Distilled Sparse Attention

    May 28, 2026Shihao Han, Hao Yang, Xinting Hu +3Video Diffusion ModelsDiffusion Transformer

  14. Bastion: Budget-Aware Speculative Decoding with Tree-structured Block Diffusion Drafting

    May 28, 2026Soowon Oh, Nam Cao, Yujin Kim +4Speculative DecodingDiffusion Language Model Decoding

  15. Cluster-Level Attention-Guided Parallel Decoding for Masked Diffusion Language Models

    May 28, 2026Heqiang Qi, Wei Huang, Mingyuan Bai +1Masked Diffusion ModelsDiffusion Language Model Inference

  16. LoRe: Adaptive Interaction-Evaluation Routing with Per-Step Interaction Budgets for Iterative Graph Solvers

    May 27, 2026Jintao Li, Yong-Yi Wang, Zheng-An Wang +1Efficient InferenceInference-Time Optimization

  17. Dynamic-dLLM: Dynamic Cache-Budget and Adaptive Parallel Decoding for Training-Free Acceleration of Diffusion LLM

    May 27, 2026Tianyi Wu, Xiaoxi Sun, Yanhua Jiao +5Diffusion Language Model InferenceDiffusion Language Model Decoding

  18. PARE: Pruning and Adaptive Routing for Efficient Video Generation

    May 26, 2026Yutong Wang, Yunke Wang, Tianfan Xue +4Video Diffusion ModelsDiffusion Transformer

  19. SoftCap: Soft-Budget Control for Diffusion Transformer Acceleration

    May 26, 2026Yuhang Zhang, Junxiang Qiu, Huixia Ben +3Diffusion TransformerDiffusion Model Caching

  20. RT-Lynx: Putting the GEMM Sparsity In a Right Way for Diffusion Models

    May 26, 2026Xing Cong, Hanlin Tang, Kan Liu +3Diffusion TransformerActivation Sparsity

  21. On the Error-Correcting Effects of Stochasticity in Discrete Diffusion

    May 26, 2026William Yuan, Sungwon Jeong, Amirali AghazadehMarkov ModelsDiffusion Sampling