Diffusion-Based Image Generation

Latest papers 189

All topics
CardsList
  1. Pooling Representation Autoencoders for Efficient Diffusion

    Oct 7, 2026Ramón Calvo-González, Youssef Saied, François FleuretAutoencodersDiffusion-Based Image Generation

  2. Backend-Agnostic Sparse Attention for Fast High-Resolution Visual Generation

    Oct 6, 2026Liao Ma, Jiayi Song, Yunfeng Wu +2Video Diffusion ModelsDiffusion Transformer

  3. Two Halves are More than One: Phase-wise Velocity Distillation for Fast and High-Quality Image Generation

    Oct 6, 2026Zhen Guo, Rongyuan Wu, Qiaosi Yi +3Diffusion Model DistillationDiffusion Distillation

  4. Level-of-Token Diffusion

    Oct 5, 2026Kiyohiro Nakayama, Brian Chao, Jan Ackermann +5Video Diffusion ModelsDiffusion Transformer

  5. LiFT: Loop Flow Transformers

    Oct 4, 2026Mohammad Mahdi Derakhshani, Pedro M. P. Curvo, Gertjan J. Burghouts +2Diffusion TransformerRecurrent Transformers

  6. FACET: Factorized Asymmetric Conditioning for Efficient Transport in High-Fidelity Fluorescence Microscopy Synthesis

    Oct 4, 2026Sazan Mahbub, Caleb N. Ellington, Eric P. XingConditional Image GenerationDiffusion-Based Image Generation

  7. DMAD: Distribution Matching as Adversarial Distillation for Fast Visual Generation

    Oct 1, 2026Zhengming Yu, Junkun Yuan, Haotian Yang +8Diffusion Model DistillationFew-Step Diffusion Sampling

  8. DC-SAE: Deep Compression Semantic Autoencoder for Faster Diffusion Convergence

    Sep 30, 2026Xu Huang, Ye Huang, Zijun Liao +6AutoencodersDiffusion-Based Image Generation

  9. From Unity Simulation to Diffusion-Based Augmentation: Quantifying Dataset Balance for Robust Object Detection

    Sep 29, 2026Mohamed Benkedadra, Aissa Saoudi, Maxime Gloesener +2Synthetic-to-Real Domain AdaptationSynthetic Data Augmentation

  10. Improved Distributional Diffusion Models

    Sep 29, 2026Tommaso Martorella, Alexandre Galashov, Felix Krause +4Few-Step Diffusion SamplingDiffusion-Based Image Generation

  11. Representation by Design in Generation: Cross-View Class-Token Alignment in Diffusion Transformers

    Sep 28, 2026Xiaoyu Wu, Yifei Wang, Chen WeiFlow MatchingDiffusion Transformer

  12. Persistence Forcing: Exploiting Feature Specialization in Pixel-Space Diffusion

    Sep 28, 2026Chong Wang, Zixuan Fu, Shiqi Huang +3Diffusion TransformerDiffusion Guidance

  13. Residual-Stream Burden Shapes Representation Learning in Diffusion Transformers

    Sep 27, 2026Tongtong Liang, Siqi Kou, Ziqiao Xi +6Diffusion TransformerResidual Learning

  14. FuseReg: Regularizing Layer Fusion Mitigates the Reconstruction-Generation Gap in Representation Autoencoders

    Sep 25, 2026Hongyang Du, Yunfei Xie, Junjie Ye +13AutoencodersImage Reconstruction

  15. PixelDiT2: Representation-Grounded Pixel Diffusion Transformers

    Sep 21, 2026Yongsheng Yu, Wei Xiong, Yichen Sheng +2Diffusion Model GuidanceDiffusion Transformer

  16. AlignMorph: Tuning-Free Diffusion Image Morphing via Explicit Semantic Transport

    Sep 21, 2026Wuyi Liu, Xu Han, Yuren Chen +3Diffusion-Based Image Generation

  17. PhysReflect: Geometry and Perception Guided Diffusion for Physically-Plausible Mirror Reflections

    Sep 20, 2026Shuheng Ge, Hongwei Ren, Li Zhang +1Diffusion Model GuidanceImage Generation

  18. Spatially Adaptive Noise Injection

    Sep 16, 2026Frantzeska Lavda, Maciej Falkiewicz, Van Khoa Nguyen +1Diffusion SamplingDiffusion-Based Image Generation

  19. Mudragen: Geometrically Supervised Generation of Interacting Two-Hand Mudras for Preserving Indian Classical Dance Heritage

    Sep 3, 2026Jagadish Kashinath Kamble, Jayanta Mukhopadhyay, Debaditya Roy +1Conditional Image GenerationHuman Motion Generation

  20. Denoising Diffusion Generative Models Secretly Calculate Attentions

    Sep 1, 2026Farzan Haddadi, Leila Monfared, Ebrahim Rezaii +3Attention Control in Diffusion ModelsDiffusion-Based Image Generation

  21. Advanced Pixel Diffusion Model with Guided Sparse Global Refinement

    Sep 1, 2026Weiyi You, Jinhua Zhang, Xingyu Zhou +3Pixel-Space Diffusion ModelsDiffusion-Based Image Generation

  22. From Local Mismatch to Global Impact: Optimizing Cache Reuse Policy for Efficient Diffusion

    Aug 13, 2026Xichen Ye, Yifan Wu, Zhikang Xie +3Video Diffusion ModelsDiffusion-Based Image Generation

  23. AdvFD: Boosting Visual Generation via Adversarial Fr'echet Distance Loss

    Aug 11, 2026Mingju Gao, Jingkai Zhou, Kun Gai +2Diffusion Model AlignmentDiffusion Model Fine-Tuning

  24. Unveiling the Secret of AdaLN-Zero in Diffusion Transformer

    Aug 10, 2026Jie Zhu, Mingyu Ding, Boqiang Duan +2Diffusion TransformerNeural Network Initialization

  25. InsertFuse: A Unified Framework for Multi-Category Reference-Guided Image Insertion

    Aug 6, 2026Guangzhao Li, Qingyan Wei, Huayu Zheng +7Conditional Image GenerationDiffusion-Based Image Generation

  26. A Foundational EDM2-Based Generative Model for High-Resolution Synthetic Fetal Ultrasound Imaging from Open Datasets

    Aug 5, 2026Harvey Mannering, Yilin Zhang, Ziao Liu +3Synthetic Data AugmentationUltrasound Imaging

  27. STEP-OPD: Rethinking Output Targets and Internal Dynamics in On-Policy Distillation for Diffusion Models

    Aug 5, 2026Qingyan Wei, Guangzhao Li, Xiaobing Tu +5Diffusion Model DistillationDiffusion-Based Image Generation

  28. Intrinsic-Hybrid Latent Diffusion Models for Generative Modeling on Unknown Manifolds

    Aug 5, 2026Yizhu Wang, Mu Niu, Xiaochen YangLatent Diffusion ModelsGenerative Modeling

  29. IRIS: Visual-Semantic Binding for Forgery-Resistant Watermarking of Diffusion Images

    Aug 4, 2026Xiaoyan Feng, Zheng Gao, Tong Guan +4Diffusion Model WatermarkingDiffusion-Based Image Generation

  30. DiverseDiT++: Quantifying, Analyzing, and Promoting Representation Diversity in Diffusion Transformers

    Aug 4, 2026Binglei Li, Mengping Yang, Zhiyu Tan +4Representation LearningDiffusion Transformer

  31. GeoCore-9B: Towards Geo-Aware Generative Foundation Models in Earth Observation

    Aug 3, 2026Jeonghyeok Do, Munchurl KimGeospatial Foundation ModelsDiffusion-Based Image Generation

  32. SPAE: Spectrally Guided Autoencoder for Pretrained Visual Latents

    Aug 2, 2026Yibin Huang, Jixiang Hong, Zongzhao Li +8AutoencodersVision Foundation Model Adaptation

  33. UDT: Reconciling U-Nets and Diffusion Transformers with Data-Adaptive Token Reduction

    Aug 2, 2026Junno Yun, Yaşar Utku Alçalar, Mehmet AkçakayaToken MergingDiffusion Transformer

  34. InstancePin: Instance-Addressable Layout-to-Image Diffusion via Coordinate Pinning

    Aug 1, 2026Chaoyue Wu, Yunfei Zhang, Si WuConditional Image GenerationImage Generation

  35. OSAGEN: Object-Aware Mask Priors and Multistage Decoupled Diffusion for Industrial Anomaly Generation

    Jul 31, 2026Jinyi Xu, Peng Chen, Yunkang Cao +3Industrial Anomaly DetectionAnomaly Localization

  36. FeatFix: Reuse What You Verify through Local Exact-Feature Correction for Faster Cached Diffusion Inference

    Jul 30, 2026Hanshuai Cui, Zhiqing Tang, Zhi Yao +3Diffusion-Based Image GenerationDiffusion Model Caching

  37. Amortized Moment Matching for Visual Generation

    Jul 29, 2026Wenze Liu, Xintao Wang, Pengfei Wan +1One-Step Generative ModelingDistribution Matching

  38. LumaGuide: Distribution Shaping for Training-Free HDR Generation in Diffusion Models

    Jul 28, 2026Bowen Chen, Shreshth Saini, Balu Adsumilli +1Diffusion Model GuidanceImage Generation

  39. Parallel Decoding Distillation for Fast Image and Video Generation

    Jul 28, 2026Neta Shaul, Chao Liu, Arash Vahdat +1Video Diffusion ModelsDiffusion Model Distillation

  40. MorphUNet: Alpha-Controlled Biometric Transport for Diffusion-Based Face Morphing Attacks

    Jul 27, 2026Taimoor Rizwan, Sara Atito, Zhenhua Feng +2Biometric IdentificationDiffusion-Based Image Generation

  41. Diff-ID: Identity Consistent Facial Image Generation and Morphing via Diffusion Models

    Jul 27, 2026Taimoor Rizwan, Sara Atito, Muhammad Awais +2Image GenerationIdentity-Preserving Image Generation

  42. OmniCache: Multidimensional Hierarchical Feature Caching For Diffusion Models

    Jul 26, 2026Zhaoyuan He, Muhammad Muaz, Lili QiuVideo Diffusion ModelsDiffusion Transformer

  43. PriSAR: 3D Geometric-Prior-Guided Diffusion for Parameter-Controlled SAR Image Generation

    Jul 25, 2026Fan Zhang, Xuanting Wu, Fei Ma +2Diffusion Model GuidanceDiffusion-Based Image Generation

  44. InnoText: A Unified Model for Visual Text Generation and Editing

    Jul 24, 2026Haowei Liu, Runze He, Jian Lu +10Diffusion TransformerDiffusion-Based Image Generation

  45. Inference-Time Scaling of Diffusion Models via Progressive Seed Pruning

    Jul 23, 2026Rogerio Guimaraes, Pietro PeronaDiffusion Model SamplingDiffusion Sampling

  46. WearWow: Native 2K Multi-Garment Virtual Try-On via Adaptive Token Packing and Preference Alignment

    Jul 22, 2026Xujie Zhang, Runyan Du, Song Chang +7Virtual Try-OnDiffusion-Based Image Generation

  47. Analytic Distribution of Classifier-Free Guidance for Schedule Design

    Jul 22, 2026Enze Jiang, Zheng MaClassifier-Free GuidanceDiffusion Sampling

  48. Local Label-Informed Feature Transfer for Generating Ground-Truth Medical Images: A Comparison of GAN- and Diffusion-Based Approaches

    Jul 21, 2026Rick Wilming, Irem Ozseker, Luca Matteo Cornils +4Diffusion-Based Image GenerationMedical Image Synthesis

  49. DuSPiT: Dual-Branch Sub-Patch Pixel Diffusion Transformer

    Jul 20, 2026Yunpeng Bai, Yossi Gandelsman, Michaël GharbiDiffusion TransformerPixel-Space Diffusion Models

  50. DiFA: Inference-Time Forward-Process Alignment for Diffusion Models

    Jul 20, 2026Shigui Li, Delu ZengDiffusion Model AlignmentDiffusion Sampling

  51. Pixel-Space Diffusion Transformers

    Jul 20, 2026Renye Yan, Jikang Cheng, You Wu +8Diffusion TransformerPixel-Space Diffusion Models

  52. Physics-aware Masked Diffusion-based Flood Simulation for Urban Fisheye Disaster Detection

    Jul 17, 2026Sodtavilan Odonchimed, Tsogt Enkhbayar, Oyunzul Munkhtamga +1Diffusion-Based Image GenerationPhysics-Based Simulation

  53. VQ-Touch: A Data-Efficient Tactile Generation Framework Across Sensors and Scenarios

    Jul 16, 2026Kailin Lyu, Long Xiao, Jianing Zeng +3Tactile SensingVector-Quantized Variational Autoencoder