Constrained RL

RL: Reinforcement Learning

Momentum

22 papers in the last four weeks, up 175% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 143

All topics
CardsList
  1. Certified Speculative Execution for Untrusted AI Agents

    Jun 30, 2026Chenyu Zhou, Qiliang Jiang, Shuning Wu +1AI Agent ReliabilityConstrained RL

  2. PPO-EAL: Exact Augmented Lagrangian Proximal Policy Optimization for Safe Robotic Control

    Jun 26, 2026Jiatao Ding, Songqun Gao, Andrea Del Prete +1Robotic ControlConstrained RL

  3. Support-Constrained RL Enables Real-World Policy Improvement without Real-World Experience

    Jun 25, 2026Raymond Yu, William Huey, Mustafa Mukadam +2RL for RoboticsRobot Policy Adaptation

  4. Average-Power-Budgeted Underwater Vehicle Control via Constrained Reinforcement Learning

    Jun 24, 2026Yinuo Wang, Gavin Tao, Yuze Liu +1RL ControlConstrained RL

  5. Bias-Controlled Primal-Dual Natural Actor-Critic: Optimal Rates for Constrained Multi-Objective Average-Reward RL

    Jun 23, 2026Ankur Naskar, Swetha Ganesh, Vaneet AggarwalMulti-Objective Reinforcement LearningReinforcement Learning

  6. Learning to Trigger: Reinforcement Learning at the Large Hadron Collider

    Jun 22, 2026Zixin Ding, Shaghayegh Emami, Giovanna Salvi +7RL ControlNon-Stationary RL

  7. Deep RL for Fast Long-Horizon Operations Scheduling on NASA's Carruthers Geocorona Observatory Mission

    Jun 20, 2026Alex Zhang, Jackson Craig, Lara WaldropReinforcement LearningLong-Horizon Planning

  8. Treatment Response Optimized Clinical Decision Support AI System via Digital Twin Simulation

    Jun 16, 2026Xinyu Qin, Anil K. Sood, Ruiheng Yu +3Clinical Decision SupportConstrained RL

  9. SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model

    Jun 15, 2026Kai Tang, Peidong Jia, Zhong Chu +15Constrained RLRobot Safety

  10. Hamilton-Jacobi Reachability-Based Safe Reinforcement Learning for Emergency Collision Avoidance

    Jun 13, 2026Yuhong Jiang, Shiyue Zhao, Junzhi Zhang +4Collision AvoidanceReachability Analysis

  11. CSPO: Constraint-Sensitive Policy Optimization for Safe Reinforcement Learning

    Jun 12, 2026Ayoub Belouadah, Sylvain Kubler, Yves Le TraonConstrained RLSafe RL

  12. Utility-Constrained Policy Optimization

    Jun 12, 2026Mehrdad Moghimi, Bernardo Avila PiresConstrained RLRisk-Sensitive RL

  13. Distribution-Agnostic Robust Trajectory Optimization via Chance-Constrained Reinforcement Learning

    Jun 11, 2026Yashdeep Chaudhary, Roberto Armellin, Harry Holt +1Trajectory OptimizationConstrained RL

  14. Seeing Before Colliding: Anticipatory Safe RL with Frozen Vision-Language Models

    Jun 9, 2026Samuel Tetteh, Cody FlemingConstrained RLRobot Safety

  15. ReflectiChain: Epistemic Grounding in LLM-Driven World Models for Supply Chain Resilience

    Jun 9, 2026Jia LuoConstrained RLLLM-Guided RL

  16. Can the Environment Speak for Itself? T2T^{2}-GRPO: A Turn-Trajectory Group Relative Policy Optimization for Caregiver Agents

    Jun 7, 2026Yutong Song, Jiang Wu, Pengfei Zhang +4Reward ShapingHealthcare

  17. Reformulate LLM Reinforcement Learning for Efficient Training under Black-box Discrepancy

    Jun 7, 2026Jiashun Liu, Runze Liu, Xu Wan +3RL for Language ModelsConstrained RL

  18. Neuro-Symbolic Injection of LTLf Constraints in Autoregressive Reinforcement Learning Policies

    Jun 6, 2026Ashkan Ansarifard, Matteo Mancanelli, Elena Umili +1Reinforcement LearningTransformer-Based RL

  19. COP-Q: Safety-First Reinforcement Learning for Robot Control via Cholesky-Ordered Projection

    Jun 3, 2026Guopeng Li, Moritz A. Zanger, Matthijs T. J. Spaan +1Robotic ControlMulti-Objective Reinforcement Learning

  20. ConTrack: Constrained Hand Motion Tracking with Adaptive Trade-off Control

    Jun 2, 2026Yutong Liang, Quanquan Peng, Ri-Zhao Qiu +1Robot Trajectory TrackingLong-Horizon Robotic Manipulation

  21. Coordination Graphs for Constrained Multi-Agent Reinforcement Learning

    Jun 1, 2026Santiago Amaya-Corredor, Miguel Calvo-Fullana, Anders JonssonMulti-Objective Reinforcement LearningMulti-Agent System Optimization

  22. Lagrangian Perturbation Diffusion Steering: Latent Reinforcement Learning for Generative Policies

    May 31, 2026Hikmet Simsir, Ozgur S. OguzRobot Policy AdaptationReinforcement Learning

  23. Detector-Evasive LLM Paraphrasing via Constrained Policy Optimization

    May 29, 2026Mingyi Wang, Zhuoer Shen, Yuheng Bu +1Constrained RLText Generation

  24. Constrained Whole-Body Tracking for Humanoid Robots

    May 29, 2026Daniel Morton, Pranit Mohnot, Marco PavoneRobotic ControlRobot Trajectory Tracking

  25. Constrained Multi-Objective Reinforcement Learning with Max-Min Criterion

    May 29, 2026Giseung Park, Hyunyoung Nam, Woohyeon Byeon +2Multi-Objective Reinforcement LearningReinforcement Learning

  26. Transferable Reinforcement Learning via Probabilistic Latent Embeddings and Dynamic Policy Adaptation for Sim-to-Real Deployment

    May 26, 2026Gengyue Han, Yiheng FengReinforcement LearningSim-to-Real Transfer

  27. Breaking the Epistemic Trap: Active Perception Under Compound Uncertainty

    May 26, 2026Chayan Banerjee, Ethan GoanActive PerceptionConstrained RL