Safe RL

RL: Reinforcement Learning

Momentum

19 papers in the last four weeks, up 138% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 156

All topics
CardsList
  1. Unmasking Toxic Mimicry in Medical Offline Reinforcement Learning for ICU Sepsis Management via Counterfactual Clinical Audits

    Aug 11, 2026Hangqi Ren, Junyi LiaoCounterfactual EvaluationOffline RL

  2. Threat-guided Policy-aware Scene Perturbation for Safe Autonomous Driving with Online Reinforcement Learning

    Aug 11, 2026Xincong Hu, Lei Ou, Maosen Li +3Adversarial Scenario GenerationSafe RL

  3. Boundary-Seeking Policy Gradient for Safe Reinforcement Learning

    Aug 10, 2026Chenhua Fan, Jiahui Zhu, Yuhang Zhang +1Markov Decision ProcessesConstrained RL

  4. Toward Integrating Adaptive Experience Replay and Online Uncertainty Estimation in Safe Actor-Critic Optimal Control

    Aug 5, 2026Mahshad Rastegarmoghaddam, Davoud Nikkhouy, Shima SamadzadehRL ControlReinforcement Learning

  5. HetGPS: Scalable Graph Multi-Agent Reinforcement Learning with Physics-Anchored Adaptive Safety for EV Charging

    Aug 1, 2026Xiangwei Wang, Nanduni Nimalsiri, Yu Xia +2Electric Vehicle ChargingSafe RL

  6. Evaluating Fuzz Testing for Reinforcement Learning Agents

    Jul 27, 2026Zhibin Kang, Hanmo You, Dong Wang +2Safe RLRobust RL

  7. Constrained Reinforcement Learning Using Successor Representations

    Jul 27, 2026Michael Girstl, Alexander Mattick, Christopher MutschlerConstrained RLSafe RL

  8. Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping

    Jul 27, 2026Stefan Richter, Alberto Giammarino, Guillem Torrente +2Robotic ControlRL Control

  9. Safe and Scalable Multi-Drone Payload Transport via CBF-based Reinforcement Learning with Zero-Shot Sim-to-Real Transfer

    Jul 22, 2026Jaeyoun Choi, Oswin So, Songyuan Zhang +2Multi-Robot SystemsControl Barrier Functions

  10. Adjustment Speed as a Safety Constraint for Nonstationary Reinforcement Learning

    Jul 21, 2026Timothy TomashevskiyNon-Stationary RLSafe RL

  11. Learning from World Feedback: Why Model Uncertainty Fails as a Risk Signal in Model-Based RL

    Jul 18, 2026Zhaohui WangRisk-Sensitive RLModel Predictive Control

  12. Certifiable Safe Model-Based Reinforcement Learning with Control-Affine Dynamics Approximation

    Jul 17, 2026Hao Zhou, Yanze Zhang, Cameron Reid +1Safe RLModel-Based RL

  13. SMC-ES: Automated synthesis of formally verified control policies

    Jul 16, 2026Riccardo Curcio, Toni Mancini, Enrico TronciFormal VerificationSafe RL

  14. Safe Execution of RL Policies Via Acceleration-Based CBF-QP Constraint Enforcement for Real-World Robotic Deployments

    Jul 16, 2026Bastien Muraccioli, Alice Cariou, Pierre-Alexandre Leziart +4Robotic ControlControl Barrier Functions

  15. SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy

    Jul 14, 2026Yassine Chemingui, Chenhua Fan, Honghao Wei +1Constrained RLRisk-Sensitive RL

  16. Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models

    Jul 14, 2026Ilias Kazantzidis, Timothy J. Norman, Yali Du +1Safe RLReward Design for RL

  17. Directional Constraints for Efficient Exploration in Safe Reinforcement Learning

    Jul 14, 2026Paolo Magliano, Puze Liu, Jan Peters +2Constrained RLRobotic RL

  18. Runtime Safety Filtering for Learned Small UAS Separation Policies under GNSS Degradation

    Jul 10, 2026Alex Zongo, Peng WeiCollision AvoidanceSafety Filtering

  19. SafeExplorer: An Unbiased Policy Gradient for Reinforcement Learning with Recovery Interventions

    Jul 9, 2026Elham Daneshmand, Majid Khadiv, Glen Berseth +1Robot SafetyProximal Policy Optimization

  20. Feedback Manipulation Regularization: Enabling Offline Agent Alignment for Imitation Learning

    Jul 8, 2026Benjamin Poole, Minwoo LeeImitation LearningSafe RL

  21. Safe Reinforcement Learning using Ideas from Model Predictive Control

    Jul 8, 2026Georg Schäfer, Jakob Rehrl, Stefan Huber +1Constrained RLSafe RL

  22. CDCP: Conditional Diffusion Model with Contextual Prompts for Multi-task Offline Safe Reinforcement Learning

    Jul 4, 2026Jiayi Guan, Tianle Zhang, Li Shen +8Reinforcement LearningConstrained RL

  23. Integrating Physics-Informed Neural Networks for Safe Reinforcement Learning in a 1-DoF Helicopter System

    Jul 3, 2026Georg Schäfer, Jakob Rehrl, Stefan HuberRL ControlReinforcement Learning

  24. Safe Online Learning via Smooth Safety-Structured Policy Composition

    Jun 30, 2026Hongpeng Cao, Liqun Zhao, Yuliang Gu +3Safety-Critical ControlSafe RL

  25. Modification-Considering Value Learning for Reward Hacking Mitigation in RL

    Jun 27, 2026Evgenii Opryshko, Umangi Jain, Igor GilitschenskiReward HackingReinforcement Learning

  26. Regularized Reward-Punishment Reinforcement Learning

    Jun 26, 2026Jiexin Wang, Eiji UchibeReinforcement LearningKL-Regularized RL

  27. PPO-EAL: Exact Augmented Lagrangian Proximal Policy Optimization for Safe Robotic Control

    Jun 26, 2026Jiatao Ding, Songqun Gao, Andrea Del Prete +1Robotic ControlConstrained RL

  28. Sample-efficient Transfer Reinforcement Learning via Adaptive Reward Shaping and Policy-Ratio Reweighting Strategy

    Jun 25, 2026Wenjie Huang, Yang Li, Jingjia Teng +6Reinforcement LearningReward Shaping