Multi-Objective Reinforcement Learning

Also known as MORL

Momentum

11 papers in the last four weeks, up 175% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 83

All topics
CardsList
  1. A3M: Adaptive, Adversarial and Multi-Objective Learning for Strategic Bidding in Repeated Auctions

    Jun 27, 2026Junhan Li, Yuxin Zhang, Haoran Wang +1Multi-Objective Reinforcement LearningGame Theory

  2. MAPL: Multi-Objective Preference Learning for Robot Locomotion

    Jun 24, 2026Xiyue Chen, Muhan Lin, Shuyang Shi +1Multi-Objective Reinforcement LearningReward Modeling

  3. Bias-Controlled Primal-Dual Natural Actor-Critic: Optimal Rates for Constrained Multi-Objective Average-Reward RL

    Jun 23, 2026Ankur Naskar, Swetha Ganesh, Vaneet AggarwalMulti-Objective Reinforcement LearningReinforcement Learning

  4. Breaking the Filter Bubble: A Semantic Pareto-DQN Framework for Multi-Objective Recommendation

    Jun 23, 2026Cláudio Lúcio Do Val Lopes, Lucca Machado da Silva, André de Oliveira BrandãoMulti-Objective Reinforcement LearningAlgorithmic Fairness

  5. Meta-Reinforcement Learning via Evolution for Multi-Objective Combinatorial Supply Chain Optimisation

    Jun 20, 2026Rifny Rachman, Bahrul Ilmi Nasution, Josh Tingey +3Multi-Objective Reinforcement LearningMulti-Objective Evolutionary Optimization

  6. Post-Training Speech Enhancement Language Models with Perceptual Rewards

    Jun 19, 2026Frédéric Berdoz, Luca A. Lanzendörfer, Antonis Asonitis +1Multi-Objective Reinforcement LearningRL for Language Models

  7. Objective-Behavior Alignment: Diagnostics for MORL Policy Selection

    Jun 19, 2026Antonio Mone, Zuzanna Osika, Florian Felten +4Multi-Objective Reinforcement LearningReinforcement Learning

  8. Pareto Q-Learning with Reward Machines

    Jun 17, 2026Arnaud Lequen, Clément Legrand-Lixon, Léo SaulièresMulti-Objective Reinforcement LearningReinforcement Learning

  9. Learning Fair Pareto-Optimal Policies in Multi-Objective Reinforcement Learning

    Jun 16, 2026Umer Siddique, Peilang Li, Yongcan CaoMulti-Objective Reinforcement LearningAlgorithmic Fairness

  10. GD2^2PO: Mitigating Multi-Reward Conflicts via Group-Dynamic reward-Decoupled Policy Optimization

    Jun 15, 2026Haotian Liu, Yihao Liu, Jingwei Ni +11Multi-Objective Reinforcement LearningRL for Language Models

  11. Towards Pareto-Optimal Tool-Integrated Agents with Pareto Ranking Policy Optimization

    Jun 15, 2026Junyi Li, Xiaowei Qian, Yingyi Zhang +6Multi-Objective Reinforcement LearningMulti-Objective Language Model Alignment

  12. Learning Coordinated Preference for Multi-Objective Multi-Agent Reinforcement Learning

    Jun 12, 2026Pengxin Wang, Lihao Guo, Yi Xie +3Multi-Objective Reinforcement LearningMulti-Agent System Optimization

  13. Critic Architecture Matters: Dual vs. Unified Critics for Humanoid Loco-Manipulation

    Jun 10, 2026Mehmet Turan YardımcıMulti-Objective Reinforcement LearningHumanoid Loco-Manipulation

  14. ReCal: Reward Calibration for RL-based LLM Routing

    Jun 10, 2026Qihang Yu, Hanwen Tong, Zhengqi Zhang +5Multi-Objective Reinforcement LearningRL for Language Models

  15. Event-Driven Reinforcement Learning Enables Long-Horizon Control in Semiconductor Fabrication

    Jun 9, 2026Yavar Yeganeh, Mahsa Shekari, Nicla Frigerio +2RL ControlMulti-Objective Reinforcement Learning

  16. SAW: Stage-Aware Dynamic Weighting for Multi-Objective Reinforcement Learning in Large Language Models

    Jun 5, 2026Yuchen He, Baolong Bi, Shenghua Liu +7Multi-Objective Reinforcement LearningRL for Language Models

  17. COP-Q: Safety-First Reinforcement Learning for Robot Control via Cholesky-Ordered Projection

    Jun 3, 2026Guopeng Li, Moritz A. Zanger, Matthijs T. J. Spaan +1Robotic ControlMulti-Objective Reinforcement Learning

  18. Coordination Graphs for Constrained Multi-Agent Reinforcement Learning

    Jun 1, 2026Santiago Amaya-Corredor, Miguel Calvo-Fullana, Anders JonssonMulti-Objective Reinforcement LearningMulti-Agent System Optimization

  19. Constrained Multi-Objective Reinforcement Learning with Max-Min Criterion

    May 29, 2026Giseung Park, Hyunyoung Nam, Woohyeon Byeon +2Multi-Objective Reinforcement LearningReinforcement Learning

  20. PEARL: Training Socratic Tutors with Pedagogically Aligned Reinforcement Learning

    May 28, 2026Qikai Chang, Zhenrong Zhang, Linbo Chen +4Multi-Objective Reinforcement LearningIntelligent Tutoring Systems

  21. Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL

    May 27, 2026Kunhao Zheng, Pierre Chambon, Juliette Decugis +4Multi-Objective Reinforcement LearningRL for Code Generation

  22. Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards

    May 26, 2026Yu Huang, Zihua Zhao, Zhaoxin Huan +9Multi-Objective Reinforcement LearningRL for Language Models

  23. Joint Optimization of Training and Inference in Federated Edge Learning via Constrained Multi-Objective Deep Reinforcement Learning

    May 25, 2026Zhen Li, Jun Cai, Chao Yang +1Multi-Objective Reinforcement LearningEdge Inference