Constrained RL

RL: Reinforcement Learning

Momentum

22 papers in the last four weeks, up 175% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 143

All topics
CardsList
  1. SiLR: Structure-Preserving Admission and Process Reward for LLM Tool Agents

    Sep 7, 2026Chenyu Zhou, Qiliang Jiang, Shuning Wu +1Constrained RLRuntime Enforcement for AI Agents

  2. SCoCaT: Success Conditioned Constrained Reinforcement Learning for Spacecraft Docking

    Sep 5, 2026Aman Arora, Ricard Marsal I Castan, Matteo El-Hariry +1Spacecraft Rendezvous and Proximity OperationsConstrained RL

  3. One Policy, Any Budget: Internalizing Budget-Aware Search via Reinforcement Learning

    Sep 1, 2026Xiaowei Sun, Jin Li, Yili Hong +2Cost-Aware InferenceConstrained RL

  4. GPAgentBench-2K: Benchmarking Large Language Model Agents in Complex Clinical Action Space

    Aug 31, 2026Boqi Chen, Xudong Liu, Yunke Ao +2HealthcareConstrained RL

  5. Redistribution-based Cost Inference Improves Sparse Safe Offline RL

    Aug 12, 2026Ebenezer Gelo, Geraud Nangue Tasse, Steven James +1Credit Assignment in RLStep-Level Credit Assignment in RL

  6. GCPO: Diagnosing and Constraining Subspace Geometry in Rollout RL for LLMs

    Aug 12, 2026Kai Yang, Jingwei Xu, Wanyu Wang +4RL for Language Model ReasoningConstrained RL

  7. Boundary-Seeking Policy Gradient for Safe Reinforcement Learning

    Aug 10, 2026Chenhua Fan, Jiahui Zhu, Yuhang Zhang +1Markov Decision ProcessesConstrained RL

  8. Navigating the Proximity-Safety Balance: Constraint Decomposition for Human Following in Pedestrian Crowds

    Aug 10, 2026Shiting Gong, Jianpeng Yao, Jinfeng Wang +2Constrained RLRobotic RL

  9. Generative Optimization for Incentivized Advertising with Global Level Constraints

    Aug 5, 2026Gege Chen, Ning Luo, Hao Jiang +7Constrained Generative ModelingOnline Advertising

  10. Hard Constraints, Smooth Gradients: Learning Feasible Inventory Policies via Differentiable Projection

    Aug 3, 2026Patrick Helm, Jan-Niklas Doerr, Joren Gijsbrechts +1Inventory ControlConstrained RL

  11. Heterogeneous Multi-Agent Reinforcement Learning for Radio Resource Management under Coupled Finite-Horizon Constraints

    Aug 3, 2026Yeonseo Jeong, Wonhyeok Ko, Sungweon Hong +1Stochastic OptimizationFair Resource Allocation

  12. Learning-Based Stochastic Optimal Control with Infinite-Horizon Probabilistic Constraints

    Aug 2, 2026Francesco Cordiano, Kanghui He, Bart De SchutterChance-Constrained OptimizationMarkov Decision Processes

  13. Learning Not to Optimize: Physics-Informed Action-Space Reshaping for Intent-Based Network Control

    Aug 2, 2026Zuyuan Zhang, Vaneet Aggarwal, Tian LanReinforcement LearningPolicy Optimization

  14. Hierarchical Multilevel Monte Carlo for Order-Optimal Neural Actor-Critic in Average-Reward CMDPs

    Jul 30, 2026Ankur Naskar, Vaneet AggarwalAverage-Reward RLConstrained RL

  15. Constrained Reinforcement Learning Using Successor Representations

    Jul 27, 2026Michael Girstl, Alexander Mattick, Christopher MutschlerConstrained RLSafe RL

  16. Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping

    Jul 27, 2026Stefan Richter, Alberto Giammarino, Guillem Torrente +2Robotic ControlRL Control

  17. Safe Remediation as Risk-Constrained Intervention Decision in Microservice Systems

    Jul 22, 2026Chengxiao Dai, Zhaokun Yan, Chenjun Lei +2Constrained RL

  18. SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy

    Jul 14, 2026Yassine Chemingui, Chenhua Fan, Honghao Wei +1Constrained RLRisk-Sensitive RL

  19. Knowledge- and Gradient-Guided Reinforcement Learning for Parametrized Action Markov Decision Processes

    Jul 14, 2026Jonas Ehrhardt, René Heesch, Oliver NiggemannReinforcement LearningConstrained RL

  20. Directional Constraints for Efficient Exploration in Safe Reinforcement Learning

    Jul 14, 2026Paolo Magliano, Puze Liu, Jan Peters +2Constrained RLRobotic RL

  21. Constraint-Aware Aggregation for Federated Reinforcement Learning in Microgrid Energy Coordination

    Jul 14, 2026Usman Haider, Karl MasonFederated Learning AggregationFederated RL

  22. PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers

    Jul 10, 2026Yujie Pang, Zudong LiReinforcement LearningContact-Rich Robotic Manipulation

  23. RLVP: Penalize the Path, Reward the Outcome

    Jul 8, 2026Bojie Li, Noah ShiAgentic RLConstrained RL

  24. Safe Reinforcement Learning using Ideas from Model Predictive Control

    Jul 8, 2026Georg Schäfer, Jakob Rehrl, Stefan Huber +1Constrained RLSafe RL

  25. CARL: Constraint-Aware Reinforcement Learning for Planning with LLMs

    Jul 6, 2026Qiuyi Qi, Jinjian Zhang, Mutian Bao +9RL for Language ModelsLLM Planning

  26. CDCP: Conditional Diffusion Model with Contextual Prompts for Multi-task Offline Safe Reinforcement Learning

    Jul 4, 2026Jiayi Guan, Tianle Zhang, Li Shen +8Reinforcement LearningConstrained RL

  27. Learning Expert Strategy for Autonomous Robotic Endovascular Intervention via Decoupled Procedural Execution

    Jun 30, 2026Yanxi Chen, Tianliang Yao, Shaolong Tang +5RL for RoboticsHierarchical RL