Constrained RL

RL: Reinforcement Learning

Momentum

22 papers in the last four weeks, up 175% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 143

All topics
CardsList
  1. A Distributionally Robust Reinforcement Learning Framework for Constrained Urban EV Dispatch

    Apr 28, 2026An Nguyen, Hoang Nguyen, Phuong Le +3Electric Vehicle ChargingConstrained RL

  2. GradMAP: Gradient-Based Multi-Agent Proximal Learning for Grid-Edge Flexibility

    Apr 27, 2026Yihong Zhou, Hongtai Zeng, Thomas MorstynMulti-Agent ControlConstrained RL

  3. CAPSULE: Control-Theoretic Action Perturbations for Safe Uncertainty-Aware Reinforcement Learning

    Apr 26, 2026Rahul Narava, Siddharth Verma, Ojas Jain +2Control Barrier FunctionsConstrained RL

  4. Bridging Reasoning and Action: Hybrid LLM-RL Framework for Efficient Cross-Domain Task-Oriented Dialogue

    Apr 25, 2026Yangyang Zhao, Linfan Dai, Li Cai +2Constrained RLLLM-Guided RL

  5. Learning Control Policies to Provably Satisfy Hard Affine Constraints for Black-Box Hybrid Dynamical Systems

    Apr 24, 2026Aayushi Shrivastava, Kartik Nagpal, Sairam Jinkala +2Dynamical SystemsSafety-Critical Control

  6. Policy Gradient Primal-Dual Method for Safe Reinforcement Learning from Human Feedback

    Apr 21, 2026Qiang Liu, Adrienne Kline, Ermin WeiConstrained RLPolicy Gradient Methods

  7. Safe RLHF Beyond Expectation: Stochastic Dominance for Universal Spectral Risk Control

    Mar 11, 2026Yaswanth Chittepu, Ativ Joshi, Rajarshi Bhattacharjee +1Constrained RLLLM Safety Alignment

  8. Expert Knowledge-driven Reinforcement Learning for Autonomous Racing via Trajectory Guidance and Dynamics Constraints

    Mar 6, 2026Bo Leng, Weiqi Zhang, Zhuoren Li +4Constrained RLAutonomous Racing

  9. Conformal Policy Control

    Mar 2, 2026Drew Prinster, Clara Fannjiang, Ji Won Park +4Constrained RLRL Exploration

  10. Constrained Group Relative Policy Optimization

    Feb 5, 2026Roger Girgis, Rodrigue de Schaetzen, Luke Rowe +3Group Relative Policy OptimizationConstrained RL

  11. Cantelli Constrained Policy Optimization

    Jan 30, 2026Rohan Tangri, Jan-Peter CalliessPolicy OptimizationConstrained RL

  12. PlatoLTL: Scaling LTL-Guided Multi-Task RL

    Jan 30, 2026Jacques Cloete, Mathias Jackermeier, Ioannis Havoutis +1RL for RoboticsConstrained RL

  13. SB-TRPO: Towards Safe Reinforcement Learning with Hard Constraints

    Dec 29, 2025Dominik Wagner, Ankit Kanwar, Luke OngSafety-Critical ControlPolicy Optimization

  14. Exchange Policy Optimization Algorithm for Semi-Infinite Safe Reinforcement Learning

    Nov 6, 2025Jiaming Zhang, Yujie Yang, Haoning Wang +2Safe RLConstrained RL

  15. Gain Tuning Is Not What You Need: Reward Gain Adaptation for Constrained Locomotion Learning

    Oct 12, 2025Arthicha Srisuchinnawong, Poramate ManoonpongConstrained RLRL for Legged Locomotion

  16. Beyond Slater's Condition in Online CMDPs with Stochastic and Adversarial Constraints

    Sep 24, 2025Francesco Emanuele Stradi, Eleonora Fidelia Chiefari, Matteo Castiglioni +2Markov Decision ProcessesConstrained RL

  17. SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems

    Jun 2, 2025Asha Ramanujam, Adam Elyoumi, Hao Chen +5RL BenchmarksConstrained RL

  18. TraCeS: Learning Per-Timestep Constraint-Violation Credit from Sparse Trajectory-Level Labels

    Apr 17, 2025Siow Meng Low, Ze Gong, Akshat KumarRL ControlCredit Assignment in RL

  19. Learning Constraints-Based Adaptive Hypergraph Neural Networks for Solving Vehicle Routing Problems

    Mar 13, 2025Zhenwei Wang, Tiehua Zhang, Jing Liu +3Constrained RLVehicle Routing

  20. Navigating Demand Uncertainty in Container Shipping: Deep Reinforcement Learning for Enabling Adaptive and Feasible Master Stowage Planning

    Feb 18, 2025Jaike van Twiller, Yossiri Adulyasak, Erick Delage +2Constrained RL

  21. Constrained Reinforcement Learning for Safe Heat Pump Control

    Sep 29, 2024Baohe Zhang, Lilli Frison, Thomas Brox +1RL ControlConstrained RL