Safe RL

RL: Reinforcement Learning

Momentum

19 papers in the last four weeks, up 138% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 153

All topics
CardsList
  1. Formal Verification of Learned Multi-Agent Communication Policies via Decision Tree Distillation

    Jun 17, 2026Ahmad Farooq, Kamran IqbalNeural Network VerificationMulti-Robot Coordination

  2. TRIDENT: Breaking the Hybrid-Safety-Physics Coupling for Provably Safe Multi-Agent Reinforcement Learning

    Jun 16, 2026Zijie Meng, Ziwei Li, Yufei Liu +5Cyber-Physical SystemsReinforcement Learning

  3. Memory-Efficient Meta-Reinforcement Learning for Adaptive Safety-Critical Control in Adversarial Spacecraft Proximity Operations

    Jun 16, 2026Alejandro Posadas-Nava, Richard Linares, Minduli WijayatungaSpacecraft Rendezvous and Proximity OperationsControl Barrier Functions

  4. SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model

    Jun 15, 2026Kai Tang, Peidong Jia, Zhong Chu +15Constrained RLRobot Safety

  5. Hamilton-Jacobi Reachability-Based Safe Reinforcement Learning for Emergency Collision Avoidance

    Jun 13, 2026Yuhong Jiang, Shiyue Zhao, Junzhi Zhang +4Collision AvoidanceReachability Analysis

  6. Safe Reinforcement Learning of Autonomous Highway Driving: A Unified Framework for Safety and Efficiency

    Jun 12, 2026Chufei Yan, Zhihao Cui, Yiyan Lv +3Reinforcement LearningMixture of Experts

  7. CSPO: Constraint-Sensitive Policy Optimization for Safe Reinforcement Learning

    Jun 12, 2026Ayoub Belouadah, Sylvain Kubler, Yves Le TraonConstrained RLSafe RL

  8. Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning

    Jun 12, 2026Omar Adalat, Edwin Hamel-De le Court, Francesco BelardinelliMulti-Agent CoordinationFormal Verification

  9. Utility-Constrained Policy Optimization

    Jun 12, 2026Mehrdad Moghimi, Bernardo Avila PiresConstrained RLRisk-Sensitive RL

  10. Individual Control Barrier Functions-Guided Diffusion Model for Safe Offline Multi-Agent Reinforcement Learning

    Jun 10, 2026Qingyun Guo, Junyi Shi, Jianuo Huang +1Control Barrier FunctionsOffline RL

  11. Seeing Before Colliding: Anticipatory Safe RL with Frozen Vision-Language Models

    Jun 9, 2026Samuel Tetteh, Cody FlemingConstrained RLRobot Safety

  12. SHAPO: Sharpness-Aware Policy Optimization for Safe Exploration

    Jun 8, 2026Kaustubh Mani, Yann Pequignot, Vincent Mai +1Sharpness-Aware MinimizationRL Exploration

  13. Safe-RULE: Safe Reinforcement UnLEarning

    Jun 8, 2026Shixiong Jiang, Taozheng Zhu, Fanxin KongOffline RLSafe RL

  14. PACT: Self-Evolving Physical Safety Alignment for Diffusion Policies in Embodied Manipulation

    Jun 7, 2026Lingxuan Wu, Zijian Zhu, Lizhong Wang +5Robot Policy LearningDiffusion Policy

  15. Merging model-based control with multi-agent reinforcement learning for multi-agent cooperative teaming strategies

    Jun 4, 2026Christian Llanes, Spencer W. Jensen, Samuel CooganMulti-Agent ControlMulti-Robot Coordination

  16. Learning of Robot Safety Policies via Adversarial Synthetic Scenarios

    Jun 4, 2026Nikolai Dorofeev, Alexey Odinokov, Rostislav YavorskiyRobot Policy LearningAdversarial Scenario Generation

  17. COP-Q: Safety-First Reinforcement Learning for Robot Control via Cholesky-Ordered Projection

    Jun 3, 2026Guopeng Li, Moritz A. Zanger, Matthijs T. J. Spaan +1Robotic ControlMulti-Objective Reinforcement Learning

  18. Explainably Safe Reinforcement Learning

    Jun 3, 2026Sabine Rieder, Stefan Pranger, Debraj Chakraborty +2Reinforcement LearningInterpretability in RL

  19. Dynamic Multi-Pair Trading Strategy in Cryptocurrency Markets with Deep Reinforcement Learning

    Jun 3, 2026Damian Lebiedź, Robert ŚlepaczukSafe RLAlgorithmic Trading

  20. Easy-to-Use Shielding for Reinforcement Learning

    Jun 2, 2026Stefan Pranger, Bettina KönighoferReinforcement LearningRL Exploration

  21. Autopilot-Preserving Residual Q-Learning with HJB-Inspired Finite-Action Risk Filtering for Fixed-Wing UAV Command Supervision

    May 31, 2026Mehmet Iscan, Batuhan TemizAerial RoboticsStochastic Optimal Control

  22. All Models are Wrong, Knowing Where is Useful: On Model Uncertainty in Reinforcement Learning

    May 31, 2026Bernd Frauenknecht, Devdutt Subhasish, Artur Eisele +2Robotic RLSafe RL

  23. Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment

    May 31, 2026Xun Shen, Yuepeng Wang, Akifumi Wachi +13Reinforcement LearningSequential Decision Making

  24. A Unified Benchmark for Dynamic Medical Treatment Reinforcement Learning

    May 31, 2026Yuepeng Wang, Ken Kawano, Yoshihiko Fujisawa +12RL BenchmarksReinforcement Learning

  25. Robust Shielding for Safe Reinforcement Learning

    May 29, 2026Edwin Hamel-De le Court, Thom Badings, Alessandro Abate +2Robust Markov Decision ProcessesFormal Verification

  26. Safe Equilibrium Policy Optimization for Strategic Agent Policies

    May 29, 2026Karthika Arumugam, Kiran Kumar Manku, Amit DhandaMulti-Agent System OptimizationGame-Playing Agents

  27. SARAD: LLM-Based Safety-Aware Hybrid Reinforcement Learning with Collision Prediction for Autonomous Driving

    May 27, 2026Kangyu Wu, Peng Cui, Guoxi Chen +1Autonomous DrivingTraffic Accident Anticipation

  28. Transferable Reinforcement Learning via Probabilistic Latent Embeddings and Dynamic Policy Adaptation for Sim-to-Real Deployment

    May 26, 2026Gengyue Han, Yiheng FengReinforcement LearningSim-to-Real Transfer

  29. Credibility-Aware Learning and Control for Safe USV Navigation under Perception Uncertainty

    May 26, 2026Yuhang Zhang, Shuqi Chai, Yukang Zhang +5Collision AvoidanceRobot Navigation

  30. Breaking the Epistemic Trap: Active Perception Under Compound Uncertainty

    May 26, 2026Chayan Banerjee, Ethan GoanActive PerceptionConstrained RL

  31. Latent Q-Barrier Shielding for Safe In-Context Reinforcement Learning

    May 24, 2026Minjae Kwon, Amir Moeini, Shangtong Zhang +1Reinforcement LearningControl Barrier Functions

  32. Counterfactually Safe Reinforcement Learning

    May 24, 2026Jingyi Li, Peng Wu, Chengchun ShiConstrained RLSafe RL

  33. Kernel-Based Safe Exploration in Deep Reinforcement Learning

    May 21, 2026Rupak Majumdar, Nikhil Singh, Sadegh SoudjaniControl Barrier FunctionsRL Exploration

  34. Implicit Safety Alignment from Crowd Preferences

    May 20, 2026Qian Lin, Daniel S. BrownSafe RLPreference-Based RL

  35. DiffCVaR: Reinforcement Learning for Risk Adaptation via Differentiable CVaR Barrier Functions

    May 20, 2026Xinyi Wang, Taekyung Kim, Bardh Hoxha +2Control Barrier FunctionsRisk-Sensitive RL

  36. PREFINE: Preference-Based Implicit Reward and Cost Fine-Tuning for Safety Alignment

    May 20, 2026Richa Verma, Bavish Kulur, Sanjay Chawla +1Direct Preference OptimizationConstrained RL

  37. Sampling-Based Safe Reinforcement Learning

    May 19, 2026Luca Vignola, Bruce D. Lee, Manish Prajapat +4Robot SafetySafe RL

  38. Generative Auto-Bidding with Unified Modeling and Exploration

    May 19, 2026Mingming Zhang, Feiqing Zhuang, Na Li +7Automated BiddingOnline Advertising

  39. Differentiable Model Predictive Safety for Heterogeneous Mobility at Urban Intersections

    May 19, 2026Wenzhe Song, Hao ZhangMulti-Agent CoordinationIntelligent Transportation Systems

  40. Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty

    May 18, 2026Prakash Aryan, Kaushik Raghupathruni, Timo Kehrer +1Pedestrian Behavior ModelingHuman Behavior Simulation

  41. Beyond Safety Filtering: Control Barrier Function-Informed Reinforcement Learning for Connected and Automated Vehicles

    May 16, 2026Jianye Xu, Bassam AlrifaeeReward ShapingControl Barrier Functions

  42. Imperfect World Models are Exploitable

    May 15, 2026Logan Mondal Bhamidipaty, Esmeralda S. Whitammer, David Abel +2Reward HackingWorld Model-Based Planning

  43. Action-Conditioned Risk Gating for Safety-Critical Control under Partial Observability

    May 14, 2026Yushen Liu, Yin-Jen Chen, Ziyi Chen +4Safety-Critical ControlPartially Observable RL

  44. Safe Continual Reinforcement Learning under Nonstationarity via Adaptive Safety Constraints

    May 13, 2026Timofey TomashevskiyNon-Stationary RLReinforcement Learning

  45. From Cumulative Constraints to Adaptive Runtime Safety Control for Nonstationary Reinforcement Learning

    May 13, 2026Timofey TomashevskiyNon-Stationary RLConstrained RL

  46. Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning

    May 12, 2026Jingduo Pan, Taoran Wu, Yiling Xue +1Constrained RLSafe RL

  47. Learning When to Act: Communication-Efficient Reinforcement Learning via Run-Time Assurance

    May 11, 2026Adam Haroon, Erick J. Rodríguez-Seda, Cody Fleming +1RL ControlLyapunov-Based Control

  48. Shields to Guarantee Probabilistic Safety in MDPs

    May 11, 2026Linus Heck, Filip Macák, Roman Andriushchenko +2Markov Decision ProcessesSafety-Critical Control

  49. Robust Probabilistic Shielding for Safe Offline Reinforcement Learning

    May 11, 2026Maris F. L. Galesloot, Thomas Rhemrev, Nils JansenOffline RLSafe RL

  50. Reinforcement Learning for Scalable and Trustworthy Intelligent Systems

    May 8, 2026Guangchen LanFederated RLPrivacy-Preserving Language Models

  51. Learned Lyapunov Shielding for Adaptive Control

    May 7, 2026Giansalvo Cirrincione, Adriano FagioliniLyapunov-Based ControlSafe RL

  52. Approximate Next Policy Sampling: Replacing Conservative Target Policy Updates in Deep RL

    May 6, 2026Dillon Sandhu, Ronald ParrPolicy OptimizationPolicy Iteration

  53. Worst-Case Discovery and Runtime Protection for RL-Based Network Controllers

    May 6, 2026Hongyu Hè, Minhao Jin, Maria ApostolakiRL ControlSafe RL

  54. Constraint-Enhanced Reinforcement Learning Based on Dynamic Decoupled Spherical Radial Squashing

    May 5, 2026Qijun Liao, Zhaoxin Yu, Jue YangRobotic ControlConstrained RL

  55. Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning

    May 4, 2026Rufeng Chen, Zhaofan Zhang, Zhejiang Yang +2Diffusion-Based PlanningDiffusion Guidance