Safe RL

RL: Reinforcement Learning

Momentum

19 papers in the last four weeks, up 138% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 153

All topics
CardsList
  1. Safe Meta-Policy Design with Risk Control

    Oct 7, 2026Wenbin Zhou, Michael Lingzhi Li, Shixiang ZhuSafe RLRisk-Sensitive RL

  2. Safe on Average, Unsafe in the Tail: When Is the Episodic-Cost Tail Controllable?

    Oct 7, 2026Samuel Tetteh, Cody FlemingSafe RLConstrained RL

  3. Reachability-Aware Diffusion Policy Optimization

    Oct 5, 2026Hikmet Simsir, Kutay Demiray, Ozgur S. OguzConstrained RLDiffusion Policy

  4. DODGER: Safety-Guided Reinforcement Learning for Robot Navigation Among Dynamic Obstacles

    Sep 30, 2026Sanghyuk Park, Kwanwoo Lee, Taekyung Kim +2RL for RoboticsControl Barrier Functions

  5. Brain-SAD: A Brain-Inspired Safe Autonomous Driving Control Framework with Dynamic Fear-Oriented Constraint on Dual-Policy

    Sep 29, 2026Huan Rong, Chao Yin, Anouar Imel +2Constrained RLRL for Autonomous Driving

  6. RoXDrive: Closed-Loop Reinforcement Learning for End-to-End Autonomous Driving via Action-Faithful Rollouts

    Sep 29, 2026Hongbin Lin, Chaoda Zheng, Yiming Yang +11End-to-End Autonomous DrivingAction-Conditioned World Models

  7. RefineDrive: Reliable Failure-Guided Learning for Vision-Language-Action Driving

    Sep 28, 2026Zhe Sun, Ziyi Luo, Yehao Lu +2VLMs for Autonomous DrivingAutonomous Driving Planning

  8. Model-Informed Safe Reinforcement Learning for Bipedal Locomotion via Step-to-Step Prediction

    Sep 28, 2026Victor Paredes, Ayonga HereidHumanoid Robot LocomotionControl Barrier Functions

  9. Vision--Language Signals in Constrained RL: Safety Gains Without Anticipation

    Sep 28, 2026Samuel Tetteh, Cody FlemingConstrained RLRL for Autonomous Driving

  10. Hierarchical Multi-agent Reinforcement Learning for Warehouse Robot Coordination under Communication Loss

    Sep 27, 2026Weihao Sun, Gehui Xu, Andreas A. MalikopoulosHierarchical RLMulti-Robot Coordination

  11. Turning Safety into Competence: Minimally Exploitable Robot Policies via Safety-Filtered Reinforcement Learning

    Sep 23, 2026Ruihan Wu, Rui Yang, Donggeon David Oh +2Sequential MARLRL for Robotics

  12. Efficient Bayes-Adaptive Reinforcement Learning with Temporal Logic Specifications

    Sep 17, 2026Jonathan Hau, Alessandro AbateBayesian RLSafe RL

  13. CALOS: Control-Affine Lyapunov On-manifold Safety Layer for Safe Deep Reinforcement Learning for Quadrotors

    Sep 15, 2026Fabrizio Cesareo, Sebastiano Mengozzi, Nicola Mimmo +1RL ControlLyapunov-Based Control

  14. ResSafe: Learning Safety Filtering with Residual Reinforcement Learning for Humanoids

    Sep 14, 2026Gechen Qu, Tong Zhang, Bike Zhang +4Safety-Critical ControlHumanoid Robot Control

  15. Safe Meta-Reinforcement Learning via Information Space Reachability

    Sep 14, 2026Zeyang Li, Sunbochen Tang, Navid AzizanReachability AnalysisConstrained RL

  16. Evaluation Metrics for Safe Reinforcement Learning

    Sep 14, 2026Lindsay Spoor, Aske Plaat, Thomas MoerlandRL BenchmarksConstrained RL

  17. When Validation Stops Learning: Auditing Update Admission for Continual Embodied Agents

    Sep 12, 2026Qinzhen Ma, Ruihai WuContinual Robot LearningSafe RL

  18. Safety-aware Skill Adaptation for Reinforcement Learning in Dynamic Environments

    Sep 11, 2026A K M Nadimul Haque, Sheila Sutjipto, Marc G. Carmichael +1Robot Policy AdaptationRobotic Manipulation

  19. A Risk-Sensitive and Uncertainty-Aware Decision-Making and Control Framework for Safe and Robust Autonomous Driving

    Sep 9, 2026Zhuoren Li, Ran Yu, Weiqi Zhang +4Control Barrier FunctionsAutonomous Driving

  20. Graph-Based Safe Reinforcement Learning for Multi-Agent Systems with Time-Varying Topology

    Sep 8, 2026Xiao Sizhe, Dong Lijing, Bai Rui +1Multi-Robot CoordinationSafe RL

  21. Proactive Context-Forecasted Safety Constraints for Nonstationary Reinforcement Learning

    Sep 8, 2026Tim TomashevskiyNon-Stationary RLConstrained RL

  22. SCoCaT: Success Conditioned Constrained Reinforcement Learning for Spacecraft Docking

    Sep 5, 2026Aman Arora, Ricard Marsal I Castan, Matteo El-Hariry +1Spacecraft Rendezvous and Proximity OperationsConstrained RL

  23. Provably Safe Sim-to-Real Transfer

    Sep 1, 2026Tingting Ni, Maryam KamgarpourReinforcement LearningSim-to-Real Transfer

  24. Redistribution-based Cost Inference Improves Sparse Safe Offline RL

    Aug 12, 2026Ebenezer Gelo, Geraud Nangue Tasse, Steven James +1Credit Assignment in RLStep-Level Credit Assignment in RL

  25. Is Per-Agent Policy Composition Safe? Rethinking Successor-Feature Transfer in Cooperative Multi-Agent Reinforcement Learning

    Aug 12, 2026Zijian Zhao, Sen LiSequential Decision MakingSafe RL

  26. Unmasking Toxic Mimicry in Medical Offline Reinforcement Learning for ICU Sepsis Management via Counterfactual Clinical Audits

    Aug 11, 2026Hangqi Ren, Junyi LiaoCounterfactual EvaluationOffline RL

  27. Threat-guided Policy-aware Scene Perturbation for Safe Autonomous Driving with Online Reinforcement Learning

    Aug 11, 2026Xincong Hu, Lei Ou, Maosen Li +3Adversarial Scenario GenerationSafe RL

  28. Boundary-Seeking Policy Gradient for Safe Reinforcement Learning

    Aug 10, 2026Chenhua Fan, Jiahui Zhu, Yuhang Zhang +1Markov Decision ProcessesConstrained RL

  29. Toward Integrating Adaptive Experience Replay and Online Uncertainty Estimation in Safe Actor-Critic Optimal Control

    Aug 5, 2026Mahshad Rastegarmoghaddam, Davoud Nikkhouy, Shima SamadzadehRL ControlReinforcement Learning

  30. HetGPS: Scalable Graph Multi-Agent Reinforcement Learning with Physics-Anchored Adaptive Safety for EV Charging

    Aug 1, 2026Xiangwei Wang, Nanduni Nimalsiri, Yu Xia +2Electric Vehicle ChargingSafe RL

  31. Evaluating Fuzz Testing for Reinforcement Learning Agents

    Jul 27, 2026Zhibin Kang, Hanmo You, Dong Wang +2Safe RLRobust RL

  32. Constrained Reinforcement Learning Using Successor Representations

    Jul 27, 2026Michael Girstl, Alexander Mattick, Christopher MutschlerConstrained RLSafe RL

  33. Bridging Reinforcement Learning and Optimal Control via Feasible Action Mapping

    Jul 27, 2026Stefan Richter, Alberto Giammarino, Guillem Torrente +2Robotic ControlRL Control

  34. Safe and Scalable Multi-Drone Payload Transport via CBF-based Reinforcement Learning with Zero-Shot Sim-to-Real Transfer

    Jul 22, 2026Jaeyoun Choi, Oswin So, Songyuan Zhang +2Multi-Robot SystemsControl Barrier Functions

  35. Adjustment Speed as a Safety Constraint for Nonstationary Reinforcement Learning

    Jul 21, 2026Timothy TomashevskiyNon-Stationary RLSafe RL

  36. Learning from World Feedback: Why Model Uncertainty Fails as a Risk Signal in Model-Based RL

    Jul 18, 2026Zhaohui WangRisk-Sensitive RLModel Predictive Control

  37. Certifiable Safe Model-Based Reinforcement Learning with Control-Affine Dynamics Approximation

    Jul 17, 2026Hao Zhou, Yanze Zhang, Cameron Reid +1Safe RLModel-Based RL

  38. SMC-ES: Automated synthesis of formally verified control policies

    Jul 16, 2026Riccardo Curcio, Toni Mancini, Enrico TronciFormal VerificationSafe RL

  39. Safe Execution of RL Policies Via Acceleration-Based CBF-QP Constraint Enforcement for Real-World Robotic Deployments

    Jul 16, 2026Bastien Muraccioli, Alice Cariou, Pierre-Alexandre Leziart +4Robotic ControlControl Barrier Functions

  40. SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy

    Jul 14, 2026Yassine Chemingui, Chenhua Fan, Honghao Wei +1Constrained RLRisk-Sensitive RL

  41. Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models

    Jul 14, 2026Ilias Kazantzidis, Timothy J. Norman, Yali Du +1Safe RLReward Design for RL

  42. Directional Constraints for Efficient Exploration in Safe Reinforcement Learning

    Jul 14, 2026Paolo Magliano, Puze Liu, Jan Peters +2Constrained RLRobotic RL

  43. Runtime Safety Filtering for Learned Small UAS Separation Policies under GNSS Degradation

    Jul 10, 2026Alex Zongo, Peng WeiCollision AvoidanceSafety Filtering

  44. SafeExplorer: An Unbiased Policy Gradient for Reinforcement Learning with Recovery Interventions

    Jul 9, 2026Elham Daneshmand, Majid Khadiv, Glen Berseth +1Robot SafetyProximal Policy Optimization

  45. Feedback Manipulation Regularization: Enabling Offline Agent Alignment for Imitation Learning

    Jul 8, 2026Benjamin Poole, Minwoo LeeImitation LearningSafe RL

  46. Safe Reinforcement Learning using Ideas from Model Predictive Control

    Jul 8, 2026Georg Schäfer, Jakob Rehrl, Stefan Huber +1Constrained RLSafe RL

  47. CDCP: Conditional Diffusion Model with Contextual Prompts for Multi-task Offline Safe Reinforcement Learning

    Jul 4, 2026Jiayi Guan, Tianle Zhang, Li Shen +8Reinforcement LearningConstrained RL

  48. Integrating Physics-Informed Neural Networks for Safe Reinforcement Learning in a 1-DoF Helicopter System

    Jul 3, 2026Georg Schäfer, Jakob Rehrl, Stefan HuberRL ControlReinforcement Learning

  49. Safe Online Learning via Smooth Safety-Structured Policy Composition

    Jun 30, 2026Hongpeng Cao, Liqun Zhao, Yuliang Gu +3Safety-Critical ControlSafe RL

  50. Modification-Considering Value Learning for Reward Hacking Mitigation in RL

    Jun 27, 2026Evgenii Opryshko, Umangi Jain, Igor GilitschenskiReward HackingReinforcement Learning

  51. Regularized Reward-Punishment Reinforcement Learning

    Jun 26, 2026Jiexin Wang, Eiji UchibeReinforcement LearningKL-Regularized RL

  52. PPO-EAL: Exact Augmented Lagrangian Proximal Policy Optimization for Safe Robotic Control

    Jun 26, 2026Jiatao Ding, Songqun Gao, Andrea Del Prete +1Robotic ControlConstrained RL

  53. Sample-efficient Transfer Reinforcement Learning via Adaptive Reward Shaping and Policy-Ratio Reweighting Strategy

    Jun 25, 2026Wenjie Huang, Yang Li, Jingjia Teng +6Reinforcement LearningReward Shaping

  54. Imagine to Ensure Safety in Hierarchical Reinforcement Learning

    Jun 21, 2026Gregory Gorbov, Artem Latyshev, Aleksandr I. PanovHierarchical RLSafe RL

  55. CRAX: Fast Safe Reinforcement Learning Benchmarking

    Jun 18, 2026Tristan Tomilin, Mourad Boustani, Mickey Beurskens +2RL BenchmarksReinforcement Learning

  56. World Engine: Towards the Era of Post-Training for Autonomous Driving

    Jun 18, 2026Tianyu Li, Li Chen, Caojun Wang +16Autonomous DrivingRL Post-Training