Constrained RL

RL: Reinforcement Learning

Momentum

22 papers in the last four weeks, up 175% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 143

All topics
CardsList
  1. When Does Deep RL Beat Calibrated Baselines? A Benchmark Study on Adaptive Resource Control

    May 26, 2026Guilin Zhang, Chuanyi Sun, Kai Zhao +3RL ControlRL Benchmarks

  2. Counterfactually Safe Reinforcement Learning

    May 24, 2026Jingyi Li, Peng Wu, Chengchun ShiConstrained RLSafe RL

  3. Reinforcement Learning with a Bilevel World-Model Architecture for Scan-Order Optimisation in Laser Directed Energy Deposition

    May 24, 2026Xian Wu, Haoran Li, Yuanqi Chu +2Constrained RL

  4. A Unified Python Framework for Direct PPO-based Control of AHUs with Economizer Logic and CO2-Constrained Ventilation

    May 23, 2026Erfan Haghighat Damavandi, Davide Papurello, Mahdi Alibeigi +3RL ControlConstrained RL

  5. FedCritic: Serverless Federated Critic Learning-based Resource Allocation for Multi-Cell OFDMA in 6G

    May 20, 2026Amin Farajzadeh, Melike Erol-KantarciFederated RL6G Networks

  6. PREFINE: Preference-Based Implicit Reward and Cost Fine-Tuning for Safety Alignment

    May 20, 2026Richa Verma, Bavish Kulur, Sanjay Chawla +1Direct Preference OptimizationConstrained RL

  7. Beyond Inference-Time Search: Reinforcement Learning Synthesizes Reusable Solvers

    May 18, 2026Soheyl Massoudi, Gabriel Apaza, Milad Habibi +1RL for Code GenerationLLM-Based Program Synthesis

  8. Addressing Terminal Constraints in Data-Driven Demand Response Scheduling

    May 14, 2026Maximilian Bloor, Martha White, Ehecatl Antonio del Rio Chanona +1Hierarchical RLCredit Assignment in RL

  9. CreFlow: Corrective Reflow for Sparse-Reward Embodied Video Diffusion RL

    May 14, 2026Zhenyang Ni, Yijiang Li, Ruochen Jiao +7Video Diffusion ModelsReinforcement Learning

  10. Safety-Constrained Reinforcement Learning with Post-Training Reachability Verification for Robot Navigation

    May 13, 2026Qisong He, Xinmiao Huang, Jinwei Hu +4Constrained RLRisk-Sensitive RL

  11. Learning Local Constraints for Reinforcement-Learned Content Generators

    May 13, 2026Debosmita Bhaumik, Julian Togelius, Georgios N. Yannakakis +1Constrained Generative ModelingConstrained RL

  12. Safe Continual Reinforcement Learning under Nonstationarity via Adaptive Safety Constraints

    May 13, 2026Timofey TomashevskiyNon-Stationary RLReinforcement Learning

  13. From Cumulative Constraints to Adaptive Runtime Safety Control for Nonstationary Reinforcement Learning

    May 13, 2026Timofey TomashevskiyNon-Stationary RLConstrained RL

  14. Optimal Policy Learning under Budget and Coverage Constraints

    May 12, 2026Giovanni CerulliPolicy OptimizationCombinatorial Optimization

  15. Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning

    May 12, 2026Jingduo Pan, Taoran Wu, Yiling Xue +1Constrained RLSafe RL

  16. Primal-Dual Policy Optimization for Linear CMDPs with Adversarial Losses

    May 12, 2026Kihyun Yu, Seoungbin Bae, Dabeen LeePrimal-Dual OptimizationMarkov Decision Processes

  17. Beyond ESG Scores: Learning Dynamic Constraints for Sequential Portfolio Optimization

    May 10, 2026Xin Li, Yan Ke, Longbing CaoConstrained RLConstrained Optimization

  18. Multi-Objective Constraint Inference using Inverse reinforcement learning

    May 7, 2026Syed Ihtesham Hussain Shah, Floris den Hengst, Aneta Lisowska +1Reinforcement LearningConstrained RL

  19. Constraint-Enhanced Reinforcement Learning Based on Dynamic Decoupled Spherical Radial Squashing

    May 5, 2026Qijun Liao, Zhaoxin Yu, Jue YangRobotic ControlConstrained RL

  20. Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning

    May 4, 2026Rufeng Chen, Zhaofan Zhang, Zhejiang Yang +2Diffusion-Based PlanningDiffusion Guidance

  21. Experience Constrained Hierarchical Federated Reinforcement Learning for Large-scale UAV Teams in Hazardous Environments

    May 4, 2026Qinwei Huang, Rui Zuo, Simon Khan +1Hierarchical Federated LearningFederated RL

  22. Global Optimality for Constrained Exploration via Penalty Regularization

    Apr 30, 2026Florian Wolf, Ilyas Fatkhullin, Niao HeConstrained RLMaximum Entropy RL

  23. Learning to Route Electric Trucks Under Operational Uncertainty

    Apr 29, 2026Stavros Orfanoudakis, Ziyan Li, Ruixiao Yang +4Sequential Decision MakingElectric Vehicle Charging