RL for Diffusion Models

RL: Reinforcement Learning

Latest papers 120

All topics
CardsList
  1. MARBLE: Multi-Aspect Reward Balance for Diffusion RL

    May 7, 2026Canyu Zhao, Hao Chen, Yunze Tong +3Multi-Objective Reinforcement LearningDiffusion Model Alignment

  2. MotionGRPO: Overcoming Low Intra-Group Diversity in GRPO-Based Egocentric Motion Recovery

    May 7, 2026Nanjie Yao, Junlong Ren, Wenhao Shen +1Diffusion Model GuidanceMarkerless Motion Capture

  3. Leveraging Verifier-Based Reinforcement Learning in Image Editing

    Apr 30, 2026Hanzhong Guo, Jie Wu, Jie Liu +6Reward ModelingReinforcement Learning

  4. AdvDMD: Adversarial Reward Meets DMD For High-Quality Few-Step Generation

    Apr 29, 2026Xu Wang, Zexian Li, Litong Gong +2Diffusion Model DistillationFew-Step Diffusion Sampling

  5. A Systematic Post-Train Framework for Video Generation

    Apr 28, 2026Zeyue Xue, Siming Fu, Jie Huang +9Diffusion Model AlignmentVideo Diffusion Models

  6. V-GRPO: Online Reinforcement Learning for Denoising Generative Models Is Easier than You Think

    Apr 25, 2026Bingda Tang, Yuhui Zhang, Xiaohan Wang +3Diffusion Model AlignmentGroup Relative Policy Optimization

  7. ParetoSlider: Diffusion Models Post-Training for Continuous Reward Control

    Apr 22, 2026Shelly Golan, Michael Finkelson, Ariel Bereslavsky +2Multi-Objective Reinforcement LearningRL for Image Generation

  8. FASTER: Value-Guided Sampling for Fast RL

    Apr 21, 2026Perry Dong, Alexander Swerdlow, Dorsa Sadigh +1Diffusion SamplingDiffusion Policy

  9. HP-Edit: A Human-Preference Post-Training Framework for Image Editing

    Apr 21, 2026Fan Li, Chonghuinan Wang, Lina Lei +9Diffusion Model AlignmentImage Editing Evaluation

  10. Learning to Credit the Right Steps: Objective-aware Process Optimization for Visual Generation

    Apr 21, 2026Rui Li, Ke Hao, Yuanzhi Liang +4Multi-Objective Reinforcement LearningVideo Diffusion Models

  11. Guiding Distribution Matching Distillation with Gradient-Based Reinforcement Learning

    Apr 21, 2026Linwei Dong, Ruoyu Guo, Ge Bai +3Diffusion Model DistillationFew-Step Diffusion Sampling

  12. Discrete Tilt Matching

    Apr 20, 2026Yuyuan Chen, Shiyi Wang, Peter Potaptchik +2Masked Diffusion ModelsRL for Language Model Reasoning

  13. UDM-GRPO: Stable and Efficient Group Relative Policy Optimization for Uniform Discrete Diffusion Models

    Apr 20, 2026Jiaqi Wang, Haoge Deng, Ting Pan +5T2I GenerationGroup Relative Policy Optimization

  14. RAD-2: Scaling Reinforcement Learning in a Generator-Discriminator Framework

    Apr 16, 2026Hao Gao, Shaoyu Chen, Yifan Zhu +4Diffusion-Based PlanningRL for Diffusion Models

  15. SHIFT: Motion Alignment in Video Diffusion Models with Adversarial Hybrid Fine-Tuning

    Mar 18, 2026Xi Ye, Wenjia Yang, Yangyang Xu +4Diffusion Model AlignmentVideo Diffusion Models

  16. LaViDa-R1: Advancing Reasoning for Unified Multimodal Diffusion Language Models

    Feb 15, 2026Shufan Li, Yuchen Zhu, Jiuxiang Gu +6Unified Multimodal ModelsMultimodal Reasoning

  17. Rethinking the Design Space of Reinforcement Learning for Diffusion Models: On the Importance of Likelihood Estimation Beyond Loss Design

    Feb 4, 2026Jaemoo Choi, Yuchen Zhu, Wei Guo +6T2I GenerationDiffusion Model Fine-Tuning

  18. ART for Diffusion Sampling: A Reinforcement Learning Approach to Timestep Schedule

    Jan 26, 2026Yilie Huang, Wenpin Tang, Xunyu ZhouDiffusion SamplingAdaptive Sampling

  19. ReDiF: Resource-Efficient Few-Step Diffusion Distillation via Reinforcement Learning

    Dec 28, 2025Amirhossein Tighkhorshid, Zahra Dehghanian, Hamid R. RabieeDiffusion DistillationRL for Diffusion Models

  20. Multi-dimensional Preference Alignment by Conditioning Reward Itself

    Dec 11, 2025Jiho Jang, Jinyoung Kim, Kyungjune Baek +1Diffusion Model AlignmentDiffusion Model Guidance

  21. Diffusion-Augmented Markov Decision Processes for Maximum Entropy Reinforcement Learning

    Dec 1, 2025Sebastian Sanokowski, Kaustubh Patil, Majid KhadivRL ControlDiffusion Policy

  22. Distribution Matching Distillation Meets Reinforcement Learning

    Nov 17, 2025Dengyang Jiang, Dongyang Liu, Zanyi Wang +12Diffusion Model AlignmentDiffusion Model Distillation

  23. Advantage Weighted Matching: Aligning RL with Pretraining in Diffusion Models

    Sep 29, 2025Shuchen Xue, Chongjian Ge, Shilong Zhang +2Score MatchingDiffusion Model Alignment

  24. MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE

    Jul 29, 2025Junzhe Li, Yutao Cui, Tao Huang +8Diffusion Model AlignmentFlow Matching

  25. DIVER: Reinforced Diffusion Breaks Imitation Bottlenecks in End-to-End Autonomous Driving

    Jul 5, 2025Ziying Song, Lin Liu, Hongyu Pan +7End-to-End Autonomous DrivingDiffusion-Based Planning

  26. DiffusionOPD: A Unified Perspective of On-Policy Distillation in Diffusion Models

    Date pendingQuanhao Li, Junqiu Yu, Kaixun Jiang +7Diffusion Model DistillationMulti-Task RL