Safe RL

RL: Reinforcement Learning

Momentum

19 papers in the last four weeks, up 138% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 153

All topics
CardsList
  1. Transferable Reinforcement Learning via Probabilistic Latent Embeddings and Dynamic Policy Adaptation for Sim-to-Real Deployment

    May 26, 2026Gengyue Han, Yiheng FengReinforcement LearningSim-to-Real Transfer

  2. Credibility-Aware Learning and Control for Safe USV Navigation under Perception Uncertainty

    May 26, 2026Yuhang Zhang, Shuqi Chai, Yukang Zhang +5Collision AvoidanceRobot Navigation

  3. Breaking the Epistemic Trap: Active Perception Under Compound Uncertainty

    May 26, 2026Chayan Banerjee, Ethan GoanActive PerceptionConstrained RL

  4. Latent Q-Barrier Shielding for Safe In-Context Reinforcement Learning

    May 24, 2026Minjae Kwon, Amir Moeini, Shangtong Zhang +1Reinforcement LearningControl Barrier Functions

  5. Counterfactually Safe Reinforcement Learning

    May 24, 2026Jingyi Li, Peng Wu, Chengchun ShiConstrained RLSafe RL

  6. Kernel-Based Safe Exploration in Deep Reinforcement Learning

    May 21, 2026Rupak Majumdar, Nikhil Singh, Sadegh SoudjaniControl Barrier FunctionsRL Exploration

  7. Implicit Safety Alignment from Crowd Preferences

    May 20, 2026Qian Lin, Daniel S. BrownSafe RLPreference-Based RL

  8. DiffCVaR: Reinforcement Learning for Risk Adaptation via Differentiable CVaR Barrier Functions

    May 20, 2026Xinyi Wang, Taekyung Kim, Bardh Hoxha +2Control Barrier FunctionsRisk-Sensitive RL

  9. PREFINE: Preference-Based Implicit Reward and Cost Fine-Tuning for Safety Alignment

    May 20, 2026Richa Verma, Bavish Kulur, Sanjay Chawla +1Direct Preference OptimizationConstrained RL

  10. Sampling-Based Safe Reinforcement Learning

    May 19, 2026Luca Vignola, Bruce D. Lee, Manish Prajapat +4Robot SafetySafe RL

  11. Generative Auto-Bidding with Unified Modeling and Exploration

    May 19, 2026Mingming Zhang, Feiqing Zhuang, Na Li +7Automated BiddingOnline Advertising

  12. Differentiable Model Predictive Safety for Heterogeneous Mobility at Urban Intersections

    May 19, 2026Wenzhe Song, Hao ZhangMulti-Agent CoordinationIntelligent Transportation Systems

  13. Multi-Agent Reinforcement Learning for Safe Autonomous Driving Under Pedestrian Behavioral Uncertainty

    May 18, 2026Prakash Aryan, Kaushik Raghupathruni, Timo Kehrer +1Pedestrian Behavior ModelingHuman Behavior Simulation

  14. Beyond Safety Filtering: Control Barrier Function-Informed Reinforcement Learning for Connected and Automated Vehicles

    May 16, 2026Jianye Xu, Bassam AlrifaeeReward ShapingControl Barrier Functions

  15. Imperfect World Models are Exploitable

    May 15, 2026Logan Mondal Bhamidipaty, Esmeralda S. Whitammer, David Abel +2Reward HackingWorld Model-Based Planning

  16. Action-Conditioned Risk Gating for Safety-Critical Control under Partial Observability

    May 14, 2026Yushen Liu, Yin-Jen Chen, Ziyi Chen +4Safety-Critical ControlPartially Observable RL

  17. Safe Continual Reinforcement Learning under Nonstationarity via Adaptive Safety Constraints

    May 13, 2026Timofey TomashevskiyNon-Stationary RLReinforcement Learning

  18. From Cumulative Constraints to Adaptive Runtime Safety Control for Nonstationary Reinforcement Learning

    May 13, 2026Timofey TomashevskiyNon-Stationary RLConstrained RL

  19. Stochastic Minimum-Cost Reach-Avoid Reinforcement Learning

    May 12, 2026Jingduo Pan, Taoran Wu, Yiling Xue +1Constrained RLSafe RL

  20. Learning When to Act: Communication-Efficient Reinforcement Learning via Run-Time Assurance

    May 11, 2026Adam Haroon, Erick J. Rodríguez-Seda, Cody Fleming +1RL ControlLyapunov-Based Control

  21. Shields to Guarantee Probabilistic Safety in MDPs

    May 11, 2026Linus Heck, Filip Macák, Roman Andriushchenko +2Markov Decision ProcessesSafety-Critical Control

  22. Robust Probabilistic Shielding for Safe Offline Reinforcement Learning

    May 11, 2026Maris F. L. Galesloot, Thomas Rhemrev, Nils JansenOffline RLSafe RL

  23. Reinforcement Learning for Scalable and Trustworthy Intelligent Systems

    May 8, 2026Guangchen LanFederated RLPrivacy-Preserving Language Models

  24. Learned Lyapunov Shielding for Adaptive Control

    May 7, 2026Giansalvo Cirrincione, Adriano FagioliniLyapunov-Based ControlSafe RL

  25. Approximate Next Policy Sampling: Replacing Conservative Target Policy Updates in Deep RL

    May 6, 2026Dillon Sandhu, Ronald ParrPolicy OptimizationPolicy Iteration

  26. Worst-Case Discovery and Runtime Protection for RL-Based Network Controllers

    May 6, 2026Hongyu Hè, Minhao Jin, Maria ApostolakiRL ControlSafe RL

  27. Constraint-Enhanced Reinforcement Learning Based on Dynamic Decoupled Spherical Radial Squashing

    May 5, 2026Qijun Liao, Zhaoxin Yu, Jue YangRobotic ControlConstrained RL

  28. Decoupled Guidance Diffusion for Adaptive Offline Safe Reinforcement Learning

    May 4, 2026Rufeng Chen, Zhaofan Zhang, Zhejiang Yang +2Diffusion-Based PlanningDiffusion Guidance