Diffusion Model Quantization

Latest papers 29

All topics
CardsList
  1. SoloQ: Calibration-Free Quantization for Diffusion Language Models

    Oct 5, 2026Donghyun Lee, Arkapravo Ghosh, Varun Manjunath +5Diffusion Model QuantizationKV-Cache Quantization

  2. Joint Branch-Space Transform Coding for Diffusion Activation Quantization with Classifier-Free Guidance

    Oct 1, 2026Mingrun Jiang, Yuejia Liu, Zishan Shao +11Classifier-Free GuidanceDiffusion Model Quantization

  3. JustQuant: You Don't Need Smoothing, SVD, or Rotation for 4-Bit Activation Quantization

    Sep 27, 2026Kaicheng Yang, Kaisen Yang, Chunyu Liu +8Diffusion Model QuantizationQuantization-Aware Training

  4. Chameleon: Dynamic Format Adapter for Efficient Diffusion

    Sep 27, 2026Arnab Sanyal, Sandeep ChinchaliDiffusion Model QuantizationPost-Training Quantization

  5. PulseQuant: Propagation-Guided Subspace Correction for 4-Bit Video Diffusion Transformers

    Sep 27, 2026Yutong Wang, Xingtong Ge, Enhuai Liu +4Video Diffusion ModelsDiffusion Transformer

  6. TASQ: Temporal-Adaptive Bit Sparsification Quantization for Diffusion Models

    Aug 4, 2026Seokho Han, Dongwei Wang, Jinhee Kim +4Mixed-Precision QuantizationDiffusion Model Quantization

  7. KroQuant: Kronecker-Structured Block Transforms for Efficient Post-Training Quantization of Diffusion Transformers

    Jul 23, 2026Yann Bouquet, Alireza Khodamoradi, Kristof Denolf +1Diffusion TransformerDiffusion Model Quantization

  8. Closing the Null Space: Guidance-Aware Quantization for Classifier-Free Diffusion

    Jul 9, 2026Abdullah Al Shafi, Sumaiya Rahim SumaMixed-Precision QuantizationClassifier-Free Guidance

  9. OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers

    Jul 2, 2026Donghyun Lee, Jitesh Chavan, Duy Nguyen +5Video Diffusion ModelsDiffusion Transformer

  10. FAIR-Calib: Frontier-Aware Instability-Reweighted Calibration for Post-Training Quantization of Diffusion Large Language Models

    Jun 4, 2026Haoyu Huang, Linlin Yang, Sheng Xu +5LLM QuantizationDiffusion Model Quantization

  11. STaR-Quant: State-Time Consistent Post-Training Quantization for Diffusion Large Language Models

    Jun 3, 2026Xin Yan, Aqiang Wang, Zhenglin Wan +2LLM QuantizationDiffusion Model Quantization

  12. Timestep-Aware SVDQuant-GPTQ for W4A4 Quantization of Wan2.2-I2V

    May 26, 2026Junhao Wu, Dezhong Yao, Hai JinVideo Diffusion ModelsDiffusion Transformer

  13. Quantized Keys Steal Attention: Bias Correction for KV-Cache Compression in Video Diffusion

    May 25, 2026Tuna Tuncer, Felix Becker, Thomas PfeilVideo Diffusion ModelsSelf-Attention

  14. Q-ARVD: Quantizing Autoregressive Video Diffusion Models

    May 20, 2026Siao Tang, Xinyin Ma, Gongfan Fang +2Video Diffusion ModelsDiffusion Model Quantization

  15. DiRotQ: Rotation-Aware Quantization for 4-bit Diffusion Transformers

    May 16, 2026Sayeh Sharify, Mahsa Salmani, Hesham MostafaDiffusion TransformerDiffusion Model Quantization

  16. PermuQuant: Lowering Per-Group Quantization Error by Reordering Channels for Diffusion Models

    May 10, 2026Yongsen Cheng, Kai Liu, Kaiwen Tao +5Diffusion Model QuantizationPost-Training Quantization

  17. On the Quantization Robustness of Diffusion Language Models in Coding Benchmarks

    Apr 22, 2026Aarav Gupta, Gururaj Deshpande, Chandreyi ChakrabortyMixed-Precision QuantizationDiffusion Model Quantization

  18. LoRaQ: Optimized Low Rank Approximation for 4-bit Quantization

    Apr 20, 2026Yann Bouquet, Alireza Khodamoradi, Sophie Yáng Shen +2Mixed-Precision QuantizationDiffusion Transformer

  19. Q-Drift: Quantization-Aware Drift Correction for Diffusion Model Sampling

    Mar 18, 2026Sooyoung Ryu, Mathieu Salzmann, Saqib JavedDiffusion Model QuantizationDiffusion Model Sampling