Diffusion Model Inference Acceleration

Latest papers 335

All topics
CardsList
  1. CoBit: Language Modeling with Bitstream Diffusion

    May 7, 2026Georgios Batzolis, Mark Girolami, Luca AmbrogioniDiffusion Language Model DecodingDiffusion Language Models

  2. P-Guide: Parameter-Efficient Prior Steering for Single-Pass CFG Inference

    May 7, 2026Xin Peng, Ang GaoFlow MatchingClassifier-Free Guidance

  3. DBMSolver: A Training-free Diffusion Bridge Sampler for High-Quality Image-to-Image Translation

    May 7, 2026Sankarshana Venugopal, Mohammad Mostafavi, Jonghyun ChoiImage-to-Image TranslationDiffusion Sampling

  4. Stream-R1: Reliability-Perplexity Aware Reward Distillation for Streaming Video Generation

    May 5, 2026Bin Wu, Mengqi Huang, Shaojin Wu +4Video Diffusion ModelsDiffusion Model Distillation

  5. Tempered Guided Diffusion

    May 5, 2026Andreas Makris, Paul Fearnhead, Chris NemethDiffusion Model SamplingDiffusion-Based Inverse Problems

  6. Performance Optimization and Comparative Analysis of Generative AI Models on Advanced Accelerators

    May 5, 2026Amitash Nanda, Javier Hernandez Nicolau, Madhusudan Gujral +3Mixed-Precision QuantizationAI Accelerator Inference

  7. Linearizing Vision Transformer with Test-Time Training

    May 4, 2026Yining Li, Dongchen Han, Zeyu Liu +3Efficient Transformer InferenceSelf-Attention

  8. Mamoda2.5: Enhancing Unified Multimodal Model with DiT-MoE

    May 4, 2026Yangming Shi, Shixiang Zhu, Tao Shen +14Diffusion TransformerUnified Multimodal Models

  9. SlimDiffSR: Toward Lightweight and Efficient Remote Sensing Image Super-Resolution via Diffusion Model Distillation

    May 4, 2026Ce Wang, Zhenyu Hu, Wanjie SunDiffusion Model DistillationRemote Sensing Image Super-Resolution

  10. SpecEdit: Training-Free Acceleration for Diffusion based Image Editing via Semantic Locking

    May 4, 2026Zhengan Yan, Shikang Zheng, Haoran Qin +9Diffusion SamplingDiffusion-Based Image Editing

  11. Motion-Aware Caching for Efficient Autoregressive Video Generation

    May 3, 2026Jing Xu, Yuexiao Ma, Xuzhe Zheng +7Video Diffusion ModelsKV-Cache Management

  12. Focus on the Core: Empowering Diffusion Large Language Models by Self-Contrast

    May 2, 2026Jinyuan Feng, Xin Yu, Yiqun Chen +5Diffusion Language Model InferenceDiffusion Language Model Decoding

  13. DARE: Diffusion Language Model Activation Reuse for Efficient Inference

    May 1, 2026Natalia Frumkin, Bokun Wang, Hung-Yueh Chiang +3Self-AttentionDiffusion Language Model Inference

  14. GD4: Graph-based Discrete Denoising Diffusion for MIMO Detection

    May 1, 2026Qincheng Lu, Sitao Luan, Xiao-Wen ChangDiffusion Model Inference AccelerationDiffusion Models

  15. YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal

    Apr 30, 2026Chenyang Wu, Lina Lei, Fan Li +6Diffusion TransformerVideo Editing

  16. Beyond Fixed Formulas: Data-Driven Linear Predictor for Efficient Diffusion Models

    Apr 29, 2026Zhirong Shen, Rui Huang, Jiacheng Liu +6Diffusion TransformerDiffusion Model Caching

  17. Characterizing Vision-Language-Action Models across XPUs: Constraints and Acceleration for On-Robot Deployment

    Apr 27, 2026Kaijun Zhou, Qiwei Chen, Da Peng +3AI Accelerator InferenceEdge Inference

  18. Z2Z^2-Sampling: Zero-Cost Zigzag Trajectories for Semantic Alignment in Diffusion Models

    Apr 26, 2026Haosen Li, Wenshuo Chen, Shaofeng Liang +3Diffusion Model AlignmentDiffusion Sampling

  19. VS-DDPM: Efficient Low-Cost Diffusion Model for Medical Modality Translation

    Apr 24, 2026Nikoo Moradi, Gijs Luijten, Behrus Hinrichs-Puladi +4Image-to-Image Translation3D Medical Imaging

  20. Accelerating Frequency Domain Diffusion Models with Error-Feedback Event-Driven Caching

    Apr 24, 2026Dong Liu, Haisheng Wang, Yanxuan YuTime Series GenerationDiffusion Model Caching

  21. MISTY: High-Throughput Motion Planning via Mixer-based Single-step Drifting

    Apr 23, 2026Yining Xing, Zehong Ke, Yiqian Tu +3Trajectory GenerationDiffusion-Based Planning

  22. Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation

    Apr 23, 2026Boxun Xu, Yuming Du, Zichang Liu +7Autoregressive DiffusionSelf-Attention

  23. DynamicRad: Content-Adaptive Sparse Attention for Long Video Diffusion

    Apr 22, 2026Yongji Long, Shijun Liang, Jintao Li +1Video Diffusion ModelsLong-Horizon Video Generation

  24. FASTER: Value-Guided Sampling for Fast RL

    Apr 21, 2026Perry Dong, Alexander Swerdlow, Dorsa Sadigh +1Diffusion SamplingDiffusion Policy

  25. NI Sampling: Accelerating Discrete Diffusion Sampling by Token Order Optimization

    Apr 20, 2026Enshu Liu, Xuefei Ning, Yu Wang +1Few-Step Diffusion SamplingDiffusion Language Model Decoding

  26. One-Step Diffusion with Inverse Residual Fields for Unsupervised Industrial Anomaly Detection

    Apr 20, 2026Boan Zhang, Wen Li, Guanhua Yu +3Industrial Anomaly DetectionUnsupervised Anomaly Detection