Multi-Objective Reinforcement Learning

Also known as MORL

Momentum

11 papers in the last four weeks, up 175% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 83

All topics
CardsList
  1. Strategic Investment Decision Making for Value Creation in Energy Transition: A Reinforcement Learning Approach

    Oct 7, 2026Yasaman Cheraghi, Reidar B. Bratvold, Aojie Hong +2Sequential Decision MakingDecision-Making under Uncertainty

  2. PROMO: Preference-conditioned Multi-Objective Reinforcement Learning for Quadrupedal Robots

    Oct 1, 2026Amr Mousa, Rifny Rachman, Neil Karavis +2Multi-Objective Reinforcement LearningEnergy-Efficient Robot Locomotion

  3. Make Sparse Rewards Count: Density-Aware Reward Aggregation for Multi-Reward RL

    Sep 30, 2026Tong Zheng, Skylar Zhai, Zhan Cheng +7Multi-Objective Reinforcement LearningReinforcement Learning

  4. MoFlow: Multi-Objective Agentic Workflow Generation

    Sep 29, 2026Yining Lu, Aurelie Lozano, Xi Yang +3Multi-Objective Reinforcement LearningAgentic Workflows

  5. CorrGRPO: Correlation-Normalized GRPO for Multi-Reward Learning

    Sep 29, 2026Wenbin Hu, Huihao Jing, Haochen Shi +3Multi-Objective Reinforcement LearningRL for Language Models

  6. ORPG: Reconciling Multiple Reward Objectives through Objective-wise Policy Gradients

    Sep 28, 2026Shicheng Fang, Yiwen Zhao, Wenbo Tian +4Multi-Objective Reinforcement LearningGradient Interference

  7. AlphaPareto: Formulaic Alpha Discovery with LLM-Guided Multi-Objective Reinforcement Learning

    Sep 28, 2026Yingbo Zhao, Zeyu Yang, Zhoufan ZhuMulti-Objective Reinforcement LearningNon-Stationary RL

  8. Evolution of fairness in multi-objective reinforcement learning framework

    Sep 28, 2026Jingyi Zhang, Xin Ou, Guozhong Zheng +3Multi-Objective Reinforcement LearningGame Theory

  9. On Preference Coverage Collapse from Hindsight Relabeling in Multi-Objective Reinforcement Learning

    Sep 22, 2026Baptiste Bonin, Caro Strickland, Audrey DurandMulti-Objective Reinforcement LearningExperience Replay

  10. CellRFT: Reinforcement Fine-Tuning for Single-Cell Perturbation Modeling

    Sep 17, 2026Jie Yan, Li Liu, Hanze Guo +7Multi-Objective Reinforcement LearningSingle-Cell Perturbation Modeling

  11. A Better Spur Should Start From Each Objective

    Sep 8, 2026Shanwen Mao, Hao Zhang, Guangtao nie +4Multi-Objective Reinforcement LearningGradient Interference

  12. Eliciting ESG Preferences for Reinforcement Learning-Based Portfolio Optimization

    Sep 2, 2026Giovanni Dispoto, Marcello Restelli, Carmine VentrePortfolio OptimizationFinance

  13. Uncovering and Mitigating Aggregation-Induced Reward Hacking in Multi-Reward Reinforcement Learning

    Aug 31, 2026Yu Yuan, Yaoyou Fan, Lili Zhao +5Multi-Objective Reinforcement LearningReward Hacking

  14. It's a matter of timescale: non-linear utility in successor features and multi-objective planning and learning

    Aug 26, 2026Liam P. H. Mertens, Lucas N. Alegre, Florent Delgrange +3Multi-Objective Reinforcement LearningSequential Decision Making

  15. Momba: Network Modernization Improves Multi-Objective Reinforcement Learning

    Aug 7, 2026Adam Štafa, Santeri Heiskanen, Petr Novotný +1Multi-Objective Reinforcement Learning

  16. SMOPD: Multi-Reward Reinforcement Learning via Specialize-and-Merge Online Policy Distillation

    Aug 4, 2026Wen Wang, Jiahua Bao, Tu Yongsiqi +8Multi-Objective Reinforcement Learning

  17. LEMUR: Learning to Align with Multi-Objective Reinforcement Learning from Preference Feedback

    Jul 31, 2026Manith Adikari, Bei Peng, Samuele Vinanzi +1Multi-Objective Reinforcement LearningReinforcement Learning

  18. Don't Mix Rewards, Mix Policies: Policy Decomposition and Optimization for Multi-Reward RL

    Jul 31, 2026Ruiming Liang, Yi Zhong, Yizhen Yuan +6Multi-Objective Reinforcement LearningRL for Language Models

  19. Deep Reinforcement Learning for Reliability Based Bi-Objective Portfolio Optimization

    Jul 7, 2026Sounaq Das, Tanmay Sen, Raghu Nandan Sengupta +1Multi-Objective Reinforcement LearningRisk-Sensitive RL

  20. Sample-Efficient Pareto Front Modeling for Energy-Aware Reinforcement Learning Using Bayesian Optimization

    Jul 3, 2026Georg Schäfer, Jakob Rehrl, Stefan Huber +1RL ControlMulti-Objective Reinforcement Learning

  21. AETDICE: Unified Framework and Offline Optimization for Nonlinear Multi-Objective RL

    Jun 30, 2026Woosung Kim, Youngjun Suh, Jinho Lee +2Multi-Objective Reinforcement LearningOffline RL

  22. Sampling-Based Coordination-Informed Multi-Objective Multi-Robot Reinforcement Learning

    Jun 29, 2026Antonio Marino, Esteban Restrepo, Soon-jo Chung +2Multi-Objective Reinforcement LearningMulti-Robot Coordination