Multi-Objective Reinforcement Learning

Also known as MORL

Momentum

11 papers in the last four weeks, up 175% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 83

All topics
CardsList
  1. Micro-Swarm Locomotion Optimization in Dynamic Flow using Multi-Objective Multi-Agent Reinforcement Learning

    May 24, 2026Josef Berman, Oren GalMulti-Objective Reinforcement LearningMulti-Agent System Optimization

  2. Emission-Aware Reinforcement Learning for Sustainable Electric Vehicle Charging and Carbon Dioxide Reduction Under Varying Renewable Penetration

    May 23, 2026Ninglin Ou, Mohammad A. Razzaque, Iftekher Islam Shovon +5RL ControlMulti-Objective Reinforcement Learning

  3. Vector Policy Optimization: Training for Diversity Improves Test-Time Search

    May 21, 2026Ryan Bahlous-Boldi, Isha Puri, Idan Shenfeld +6Multi-Objective Reinforcement LearningReinforcement Learning

  4. Two is better than one: A Collapse-free Multi-Reward RLIF Training Framework

    May 21, 2026Shourov Joarder, Diganta Sikdar, Ahsan Habib Akash +2Multi-Objective Reinforcement LearningIntrinsic Reward Methods

  5. Adaptive Smooth Tchebycheff Attention for Multi-Objective Policy Optimization

    May 12, 2026Alejandro Murillo-Gonzalez, Mahmoud Ali, Lantao LiuMulti-Objective Reinforcement LearningPolicy Optimization

  6. Split the Differences, Pool the Rest: Provably Efficient Multi-Objective Imitation

    May 12, 2026Ziyad Sheebaelhamd, Luca Viano, Volkan Cevher +1Multi-Objective Reinforcement LearningImitation Learning

  7. Controllability in preference-conditioned multi-objective reinforcement learning

    May 11, 2026Pau de las Heras Molins, Beyazit Yalcinkaya, Lasse Peters +2Multi-Objective Reinforcement LearningPreference-Based RL

  8. A Single Deep Preference-Conditioned Policy for Learning Pareto Coverage Sets

    May 9, 2026Akihiro Kubo, Kosuke Nakanishi, Shin IshiiMulti-Objective Reinforcement LearningPolicy Optimization

  9. A Production-Ready RL Framework for Personalized Utility Tuning with Pareto Sweeping in Pinterest Recommender Systems

    May 8, 2026Yichu Zhou, Mehdi Ben Ayed, Lin Yang +9Multi-Objective Reinforcement LearningRecommender Systems

  10. MARBLE: Multi-Aspect Reward Balance for Diffusion RL

    May 7, 2026Canyu Zhao, Hao Chen, Yunze Tong +3Multi-Objective Reinforcement LearningDiffusion Model Alignment

  11. Dueling DDQN-Based Adaptive Multi-Objective Handover Optimization for LEO Satellite Networks

    May 4, 2026Po-Heng Chou, Chiapin Wang, Chung-Chi Huang +1Multi-Objective Reinforcement LearningDeep Q-Learning

  12. Protein-Conditioned Multi-Objective Reinforcement Learning for Full-Length mRNA Design

    May 2, 2026Zixi Shao, Tao Wang, Yibei Xiao +1Multi-Objective Reinforcement LearningMolecular Generation

  13. A Reward-Free Viewpoint on Multi-Objective Reinforcement Learning

    Apr 27, 2026Ying-Tu Chen, Wei Hung, Bing-Shu Wu +2Multi-Objective Reinforcement LearningReinforcement Learning

  14. POCA: Pareto-Optimal Curriculum Alignment for Visual Text Generation

    Apr 27, 2026Yaohou Fan, Qingzhong Wang, Yongsong Huang +3Multi-Objective Reinforcement LearningRL for Image Generation

  15. ParetoSlider: Diffusion Models Post-Training for Continuous Reward Control

    Apr 22, 2026Shelly Golan, Michael Finkelson, Ariel Bereslavsky +2Multi-Objective Reinforcement LearningRL for Image Generation

  16. Learning to Credit the Right Steps: Objective-aware Process Optimization for Visual Generation

    Apr 21, 2026Rui Li, Ke Hao, Yuanzhi Liang +4Multi-Objective Reinforcement LearningVideo Diffusion Models

  17. Multi-objective Reinforcement Learning With Augmented States Requires Rewards After Deployment

    Apr 17, 2026Peter Vamplew, Cameron FoaleMulti-Objective Reinforcement LearningReinforcement Learning

  18. Spatiotemporal Continual Federated Learning for Agentic Multi-UAV Edge Networks: Mitigating Catastrophic Forgetting

    Jan 29, 2026Chuan-Chi LaiMulti-Objective Reinforcement LearningFederated RL

  19. GraphAllocBench: A Flexible Benchmark for Preference-Conditioned Multi-Objective Policy Learning

    Jan 28, 2026Zhiheng Jiang, Yunzhe Wang, Ryan Marr +3Multi-Objective Reinforcement LearningRL Benchmarks

  20. Integrated Noise and Safety Management in UAM via A Unified Reinforcement Learning Framework

    Aug 22, 2025Surya Murthy, Zhenyu Gao, John-Paul Clarke +1Multi-Objective Reinforcement LearningCollision Avoidance