Safe RL

RL: Reinforcement Learning

Momentum

19 papers in the last four weeks, up 138% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 153

All topics
CardsList
  1. Formal Verification of Learned Multi-Agent Communication Policies via Decision Tree Distillation

    Jun 17, 2026Ahmad Farooq, Kamran IqbalNeural Network VerificationMulti-Robot Coordination

  2. TRIDENT: Breaking the Hybrid-Safety-Physics Coupling for Provably Safe Multi-Agent Reinforcement Learning

    Jun 16, 2026Zijie Meng, Ziwei Li, Yufei Liu +5Cyber-Physical SystemsReinforcement Learning

  3. Memory-Efficient Meta-Reinforcement Learning for Adaptive Safety-Critical Control in Adversarial Spacecraft Proximity Operations

    Jun 16, 2026Alejandro Posadas-Nava, Richard Linares, Minduli WijayatungaSpacecraft Rendezvous and Proximity OperationsControl Barrier Functions

  4. SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model

    Jun 15, 2026Kai Tang, Peidong Jia, Zhong Chu +15Constrained RLRobot Safety

  5. Hamilton-Jacobi Reachability-Based Safe Reinforcement Learning for Emergency Collision Avoidance

    Jun 13, 2026Yuhong Jiang, Shiyue Zhao, Junzhi Zhang +4Collision AvoidanceReachability Analysis

  6. Safe Reinforcement Learning of Autonomous Highway Driving: A Unified Framework for Safety and Efficiency

    Jun 12, 2026Chufei Yan, Zhihao Cui, Yiyan Lv +3Reinforcement LearningMixture of Experts

  7. CSPO: Constraint-Sensitive Policy Optimization for Safe Reinforcement Learning

    Jun 12, 2026Ayoub Belouadah, Sylvain Kubler, Yves Le TraonConstrained RLSafe RL

  8. Contract-Based Compositional Shielding for Safe Multi-Agent Reinforcement Learning

    Jun 12, 2026Omar Adalat, Edwin Hamel-De le Court, Francesco BelardinelliMulti-Agent CoordinationFormal Verification

  9. Utility-Constrained Policy Optimization

    Jun 12, 2026Mehrdad Moghimi, Bernardo Avila PiresConstrained RLRisk-Sensitive RL

  10. Individual Control Barrier Functions-Guided Diffusion Model for Safe Offline Multi-Agent Reinforcement Learning

    Jun 10, 2026Qingyun Guo, Junyi Shi, Jianuo Huang +1Control Barrier FunctionsOffline RL

  11. Seeing Before Colliding: Anticipatory Safe RL with Frozen Vision-Language Models

    Jun 9, 2026Samuel Tetteh, Cody FlemingConstrained RLRobot Safety

  12. SHAPO: Sharpness-Aware Policy Optimization for Safe Exploration

    Jun 8, 2026Kaustubh Mani, Yann Pequignot, Vincent Mai +1Sharpness-Aware MinimizationRL Exploration

  13. Safe-RULE: Safe Reinforcement UnLEarning

    Jun 8, 2026Shixiong Jiang, Taozheng Zhu, Fanxin KongOffline RLSafe RL

  14. PACT: Self-Evolving Physical Safety Alignment for Diffusion Policies in Embodied Manipulation

    Jun 7, 2026Lingxuan Wu, Zijian Zhu, Lizhong Wang +5Robot Policy LearningDiffusion Policy

  15. Merging model-based control with multi-agent reinforcement learning for multi-agent cooperative teaming strategies

    Jun 4, 2026Christian Llanes, Spencer W. Jensen, Samuel CooganMulti-Agent ControlMulti-Robot Coordination

  16. Learning of Robot Safety Policies via Adversarial Synthetic Scenarios

    Jun 4, 2026Nikolai Dorofeev, Alexey Odinokov, Rostislav YavorskiyRobot Policy LearningAdversarial Scenario Generation

  17. COP-Q: Safety-First Reinforcement Learning for Robot Control via Cholesky-Ordered Projection

    Jun 3, 2026Guopeng Li, Moritz A. Zanger, Matthijs T. J. Spaan +1Robotic ControlMulti-Objective Reinforcement Learning

  18. Explainably Safe Reinforcement Learning

    Jun 3, 2026Sabine Rieder, Stefan Pranger, Debraj Chakraborty +2Reinforcement LearningInterpretability in RL

  19. Dynamic Multi-Pair Trading Strategy in Cryptocurrency Markets with Deep Reinforcement Learning

    Jun 3, 2026Damian Lebiedź, Robert ŚlepaczukSafe RLAlgorithmic Trading

  20. Easy-to-Use Shielding for Reinforcement Learning

    Jun 2, 2026Stefan Pranger, Bettina KönighoferReinforcement LearningRL Exploration

  21. Autopilot-Preserving Residual Q-Learning with HJB-Inspired Finite-Action Risk Filtering for Fixed-Wing UAV Command Supervision

    May 31, 2026Mehmet Iscan, Batuhan TemizAerial RoboticsStochastic Optimal Control

  22. All Models are Wrong, Knowing Where is Useful: On Model Uncertainty in Reinforcement Learning

    May 31, 2026Bernd Frauenknecht, Devdutt Subhasish, Artur Eisele +2Robotic RLSafe RL

  23. Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment

    May 31, 2026Xun Shen, Yuepeng Wang, Akifumi Wachi +13Reinforcement LearningSequential Decision Making

  24. A Unified Benchmark for Dynamic Medical Treatment Reinforcement Learning

    May 31, 2026Yuepeng Wang, Ken Kawano, Yoshihiko Fujisawa +12RL BenchmarksReinforcement Learning

  25. Robust Shielding for Safe Reinforcement Learning

    May 29, 2026Edwin Hamel-De le Court, Thom Badings, Alessandro Abate +2Robust Markov Decision ProcessesFormal Verification

  26. Safe Equilibrium Policy Optimization for Strategic Agent Policies

    May 29, 2026Karthika Arumugam, Kiran Kumar Manku, Amit DhandaMulti-Agent System OptimizationGame-Playing Agents

  27. SARAD: LLM-Based Safety-Aware Hybrid Reinforcement Learning with Collision Prediction for Autonomous Driving

    May 27, 2026Kangyu Wu, Peng Cui, Guoxi Chen +1Autonomous DrivingTraffic Accident Anticipation