Diffusion Model Inference Acceleration

Latest papers 335

All topics
CardsList
  1. Linear Fusion MultiDiffusion for Fast Training-Free Spherical Panorama Generation

    Sep 2, 2026Akio Hayakawa, Yusuke Mukuta, Tatsuya HaradaImage GenerationDiffusion Model Inference Acceleration

  2. P-PatchDiff: Progressive Patch Diffusion Models for Low-light Image Enhancement

    Sep 1, 2026Ruoyu Guo, Haonan Zhong, Maurice Pagnucco +1Diffusion Models for Image RestorationLow-Light Image Enhancement

  3. Identity-Conditioned Latent Consistency Distillation for Face Synthesis

    Aug 31, 2026Tiago Kienen Chaves, Bernardo Biesseck, David MenottiSynthetic Data AugmentationLatent Diffusion Models

  4. Efficient and High-Quality Depth Estimation via Pixel-Space Diffusion with Linear Attention

    Aug 31, 2026Bingde Liu, Wu Ran, Jinglei Zhang +2Monocular Depth EstimationPixel-Space Diffusion Models

  5. RegionCache: Semantic-Aware Region Reuse for Efficient Multi-Turn Image Generation

    Aug 30, 2026Peizheng Li, Xin Ai, Hanyuan Liu +2Diffusion Model CachingDiffusion-Based Image Editing

  6. TurboT2VA: Fast Large-Scale Text-to-Video-Audio Generation via Score-Regularized Consistency Distillation

    Aug 25, 2026Xiaoda Yang, Yuxiang Liu, Kaiwen Zheng +12Audio-Video GenerationDiffusion Model Distillation

  7. Beyond Attention Masks: Instruction Anchoring for Efficient In-Context Diffusion Generation

    Aug 21, 2026Yangshuai Liu, Zheming Li, Jiaao Li +4Diffusion TransformerDiffusion Model Caching

  8. GeoCache: Training-Free Acceleration of Multi-View Texture Diffusion via Geometric Delta Transport

    Aug 13, 2026Haotang Li, Zhenyu Qi, Shaohan Henry Wang +6Multi-View ConsistencyGenerative Modeling

  9. From Local Mismatch to Global Impact: Optimizing Cache Reuse Policy for Efficient Diffusion

    Aug 13, 2026Xichen Ye, Yifan Wu, Zhikang Xie +3Video Diffusion ModelsDiffusion-Based Image Generation

  10. FlashDrive: Flash Vision-Language-Action Inference for Autonomous Driving

    Aug 13, 2026Zekai Li, Yihao Liang, Hongfei Zhang +3Efficient VLA Model InferenceAutonomous Driving

  11. GeoFlow: Efficient Driving Video Generation via Geometry-Aligned Priors

    Aug 12, 2026Jiazheng Liu, Hang Li, Jiawei Zhang +5Few-Step Diffusion SamplingVideo Generation

  12. LoSA: Near-Lossless Sparse Attention for Training-Free Video Diffusion Acceleration

    Aug 12, 2026Enhuai Liu, Yunke Wang, Yutong Wang +2Video Diffusion ModelsDiffusion Transformer

  13. MeanSR: Restoration Trajectory Learning for One-Step Perceptual Super-Resolution

    Aug 10, 2026Axi Niu, Jiawei Kou, Kang Zhang +3Diffusion Model Inference AccelerationImage Super-Resolution

  14. Archer: Adaptive Reuse of Cached Hidden States for Efficient Rollback in Diffusion Language Models

    Aug 8, 2026Xuning He, Zinan Sheng, Yongding Tao +4Diffusion Language Model InferenceDiffusion Model Caching

  15. Local Epistemic Uncertainty Guided Active Sampling for Plug-and-play Diffusive Image Restoration

    Aug 7, 2026Jiaqi Zhang, Zheng Pang, Rongrong Gao +2Diffusion Models for Image RestorationDiffusion Model Guidance

  16. ControlRef: Efficient Layout-Guided Multi-Instance Generation via Anchored 4D-RoPE

    Aug 7, 2026Yunkai Yang, Yudong Zhang, Xinying Chen +7Rotary Positional EmbeddingsDiffusion Transformer

  17. Adaptive-WAM: Quality-Guided Early-Exit Planning from Intermediate Video-Diffusion Features

    Aug 6, 2026Sining Ang, Yuguang Yang, Yan WangEfficient InferenceDiffusion Transformer

  18. In-Context Forcing: Uncovering Context Effects in Autoregressive Video Diffusion

    Aug 5, 2026Lingxiao Yang, Liu Liu, Moran Li +4Video Diffusion ModelsAutoregressive Video Generation

  19. Deltoris: Enabling Real-time VLA Inference in Embodied AI via Bit-level Sparsity and Speculative Inference

    Aug 5, 2026Zheng Liu, Zeyu Guo, Zihan Liu +9AI Accelerator InferenceEfficient VLA Model Inference

  20. BRACE: Taming Sharp Irregularities via Barycentric Rational Forecasting for Fast Diffusion Transformers Inference

    Aug 4, 2026Jinlong Yang, Jinke Wu, Lizilin +1Diffusion TransformerDiffusion Model Caching

  21. SPADE: An Input-Adaptive Sparse Attention Engine for Fast Video Diffusion Models Inference

    Aug 4, 2026Shanghao Liu, Renze Chen, Size Zheng +4Video Diffusion ModelsDiffusion Transformer

  22. Token Radius Attention for Efficient Video Generation

    Aug 3, 2026Jiayu Chen, Zhikun Jiang, Maoliang Li +6Video Diffusion ModelsSparse Attention

  23. xPress: Parallel Refinement for Diffusion Drafters in Speculative Decoding

    Aug 3, 2026Zheng Wang, Davis Wertheimer, Yu Chin Fabian Lim +4Speculative Decoding for Diffusion Language ModelsSpeculative Decoding