Constrained RL

RL: Reinforcement Learning

Momentum

22 papers in the last four weeks, up 175% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 143

All topics
CardsList
  1. FAITH: Feasibility-Aware Safety-Filtered RL for High-Dimensional Systems

    Oct 8, 2026Songyuan Zhang, Baljeet Singh, Sarthak Ranjeet Kaingade +2Safe RLConstrained RL

  2. A Unified Bellman Operator for Safety-Critical Reinforcement Learning

    Oct 8, 2026Nishanth Arun Rao, Royina Karegoudra Jayanth, Benjamin Eysenbach +1Safe RLConstrained RL

  3. Toward Optimal Regret in Adversarial MDPs with Stochastic Hard Constraints

    Oct 8, 2026Qian Zuo, Francesco Emanuele StradiMarkov Decision ProcessesConstrained RL

  4. Constrained Command-Conditioned Reinforcement Learning with Bandit Strategy Selection in Real-Time Strategy Games

    Oct 8, 2026Nick Leenders, Roy Lindelauf, Joost van Oijen +1Reinforcement LearningGame-Playing Agents

  5. Safe on Average, Unsafe in the Tail: When Is the Episodic-Cost Tail Controllable?

    Oct 7, 2026Samuel Tetteh, Cody FlemingSafe RLConstrained RL

  6. Learning Unknown Constraints without Unsafe Data via Optimality and Counterfactual Regularization

    Oct 7, 2026Zhouyu Zhang, Chih-Yuan Chiu, Glen ChouConstrained RLLearning from Demonstration

  7. Who Bears the Burden? Learning Responsibility for Shared Constraints in Multi-Agent Reinforcement Learning

    Oct 5, 2026Xiaoyang Cao, Jingqi Li, Zhe Fu +1Game TheoryConstrained RL

  8. Constrained Goal-directed Planar Graph Generation with Grammar-based Reinforcement Learning

    Oct 5, 2026Nicolas Hochuli, Lorenzo Miele, Kristina Shea +1Constrained Generative ModelingGraph Generation

  9. Reachability-Aware Diffusion Policy Optimization

    Oct 5, 2026Hikmet Simsir, Kutay Demiray, Ozgur S. OguzConstrained RLDiffusion Policy

  10. Rate-Optimal Algorithm for Adversarial Linear CMDPs

    Oct 1, 2026Kihyun Yu, Honghao Wei, Dabeen LeeRegret Minimization in RLMarkov Decision Processes

  11. Learning Infinite-Horizon Average-Reward CMDPs via State Augmentation

    Sep 30, 2026Kihyun Yu, Seoungbin Bae, Dabeen LeeRegret Minimization in RLMarkov Decision Processes

  12. VERA: Verifiable Feasibility Representations with Counterfactual Credit for Constrained Multi-Agent Control

    Sep 30, 2026Bo Yin, Dongbo Li, Hongkai Chen +2Multi-Agent ControlConstrained RL

  13. Brain-SAD: A Brain-Inspired Safe Autonomous Driving Control Framework with Dynamic Fear-Oriented Constraint on Dual-Policy

    Sep 29, 2026Huan Rong, Chao Yin, Anouar Imel +2Constrained RLRL for Autonomous Driving

  14. Learning to Harvest Without Collapse in a Regenerative Commons: A Lagrangian Framework

    Sep 29, 2026Jose Tupayachi, Xueping Li, Soham DasMulti-Agent ControlConstrained RL

  15. PowerZooJax: A JAX-based Power System Benchmark for Reinforcement Learning

    Sep 28, 2026Zhanhua Pan, Xiao Liu, Zhilong Cao +2RL BenchmarksConstrained RL

  16. Safe Greenhouse Climate Control Using Lagrangian-Constrained PPO with Kolmogorov-Arnold Networks

    Sep 28, 2026Hangzun Liu, Yuling Fan, Fang Tian +3Constrained RLProximal Policy Optimization

  17. Finite-Time Concentration and Convergence Rates for Projected Two-Time-Scale Stochastic Approximation with Markov Noise

    Sep 28, 2026Rahul Singh, Vivek S. Borkar, Eric MoulinesLast-Iterate ConvergenceStochastic Approximation

  18. Model-Informed Safe Reinforcement Learning for Bipedal Locomotion via Step-to-Step Prediction

    Sep 28, 2026Victor Paredes, Ayonga HereidHumanoid Robot LocomotionControl Barrier Functions

  19. Q-learning Penalized Transformer for Safe Offline Reinforcement Learning

    Sep 28, 2026Shengchao Hu, Peng Wang, Jifeng Hu +5Reinforcement LearningTransformer-Based RL

  20. Vision--Language Signals in Constrained RL: Safety Gains Without Anticipation

    Sep 28, 2026Samuel Tetteh, Cody FlemingConstrained RLRL for Autonomous Driving

  21. Smoothness as a Constraint for Stable Humanoid Locomotion

    Sep 21, 2026Utsav Panchal, Denis Kleyko, Unal Artan +1Robotic ControlHumanoid Robot Locomotion

  22. Do Language Models Need Music Supervision? Verifiable Rewards for Multi-Constraint Symbolic Music Generation

    Sep 20, 2026Haoyue Liu, Xiaoying TangMusic Generation EvaluationControllable Music Generation

  23. Cost-Aware Reinforcement Learning with Action Masking and Projection for Battery Energy Storage Dispatch under Suppressed-Spread Market Shifts

    Sep 20, 2026Kuanlin Chen, Chen-Wei Kuo, Cheng-En OuConstrained RLProximal Policy Optimization

  24. Safe Meta-Reinforcement Learning via Information Space Reachability

    Sep 14, 2026Zeyang Li, Sunbochen Tang, Navid AzizanReachability AnalysisConstrained RL

  25. Evaluation Metrics for Safe Reinforcement Learning

    Sep 14, 2026Lindsay Spoor, Aske Plaat, Thomas MoerlandRL BenchmarksConstrained RL

  26. Comfort by Construction: Adaptive, Comfort-Bounded Action Spaces for Learned Driving Policies

    Sep 14, 2026Anna Rothenhäusler, Daniel Jost, Raghu Rajan +4Constrained RLVehicle Dynamics

  27. A Unified and Constrained View of Regularization-Based Robust Reinforcement Learning

    Sep 14, 2026Amine Andam, Jamal Bentahar, Mustapha HedabouKL-Regularized RLAdversarial Robustness

  28. Proactive Context-Forecasted Safety Constraints for Nonstationary Reinforcement Learning

    Sep 8, 2026Tim TomashevskiyNon-Stationary RLConstrained RL