Risk-Sensitive RL

RL: Reinforcement Learning

Momentum

10 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 58

All topics
CardsList
  1. Utility-Constrained Policy Optimization

    Jun 12, 2026Mehrdad Moghimi, Bernardo Avila PiresConstrained RLRisk-Sensitive RL

  2. Safety-Contract Graph Multi-Agent Reinforcement Learning for Autonomous Network Security Response

    Jun 11, 2026Jose Luis Lima de Jesus SilvaAutonomous Cyber DefenseRisk-Sensitive RL

  3. Uncertainty-Aware and Temporally Regulated Expert Advice in Reinforcement Learning for Autonomous Driving

    May 28, 2026Ahmed Abouelazm, Felix Klingebiel, Philip Schörner +1Reinforcement LearningRisk-Sensitive RL

  4. Evolving Robustness--Exploration Trade-off in Online Reinforcement Learning via Quantile Bayesian Risk MDPs

    May 23, 2026Meichen Song, Yuhao Wang, Enlu ZhouReinforcement LearningBayesian RL

  5. On the Sample Complexity of Discounted Reinforcement Learning with Optimized Certainty Equivalents

    May 20, 2026Oliver Mortensen, Mohammad Sadegh TalebiReinforcement LearningRisk-Sensitive RL

  6. DiffCVaR: Reinforcement Learning for Risk Adaptation via Differentiable CVaR Barrier Functions

    May 20, 2026Xinyi Wang, Taekyung Kim, Bardh Hoxha +2Control Barrier FunctionsRisk-Sensitive RL

  7. SafeAlign-VLA: A Negative-Enhanced Safe Alignment Framework for Risk-Aware Autonomous Driving

    May 19, 2026Kefei Tian, Yuansheng Lian, Kai Yang +2End-to-End Autonomous DrivingRisk-Sensitive RL

  8. Action-Conditioned Risk Gating for Safety-Critical Control under Partial Observability

    May 14, 2026Yushen Liu, Yin-Jen Chen, Ziyi Chen +4Safety-Critical ControlPartially Observable RL

  9. Safety-Constrained Reinforcement Learning with Post-Training Reachability Verification for Robot Navigation

    May 13, 2026Qisong He, Xinmiao Huang, Jinwei Hu +4Constrained RLRisk-Sensitive RL

  10. Tight Sample Complexity Bounds for Entropic Best Policy Identification

    May 13, 2026Amer Essakine, Claire VernadeReinforcement LearningRisk-Sensitive RL

  11. Reinforcement Learning for Exponential Utility: Algorithms and Convergence in Discounted MDPs

    May 8, 2026Gugan Thoppe, L. A. Prashanth, Ankur Naskar +1Markov Decision ProcessesReinforcement Learning

  12. Actor-Critic Algorithm for Dynamic Expectile and CVaR

    May 8, 2026Yudong Luo, Erick DelageReinforcement LearningRisk-Sensitive RL

  13. Learning Material-Aware Hamiltonian Risk Fields for Safe Navigation

    May 7, 2026Aditya Sai Ellendula, Yi Wang, Chandrajit BajajCollision AvoidanceDynamical Systems

  14. Quantile Geometry Regularization for Distributional Reinforcement Learning

    May 5, 2026Zhaofan Zhang, Minghao Yang, Rufeng Chen +2Distributional RLQuantile Regression

  15. MARS-DA: A Hierarchical Reinforcement Learning Framework for Risk-Aware Multi-Agent Bidding in Power Grids

    May 4, 2026Jiayi Chen, Xuan Zhang, Guiling WangHierarchical RLRisk-Sensitive RL

  16. Reinforcement Learning with Markov Risk Measures and Multipattern Risk Approximation

    May 1, 2026Andrzej Ruszczynski, Tiangang ZhangMarkov Decision ProcessesReinforcement Learning

  17. Frictive Policy Optimization for LLMs: Epistemic Intervention, Risk-Sensitive Control, and Reflective Alignment

    Apr 28, 2026James Pustejovsky, Nikhil KrishnaswamyRL for Language ModelsLanguage Model Safety Evaluation

  18. The Price of Paranoia: Robust Risk-Sensitive Cooperation in Non-Stationary Multi-Agent Reinforcement Learning

    Apr 17, 2026Deep Kumar Ganguly, Chandradithya S Jonnalagadda, Pratham Chintamani +1Cooperative Game TheoryMulti-Agent Coordination

  19. Safe RLHF Beyond Expectation: Stochastic Dominance for Universal Spectral Risk Control

    Mar 11, 2026Yaswanth Chittepu, Ativ Joshi, Rajarshi Bhattacharjee +1Constrained RLLLM Safety Alignment

  20. Reinforcement learning with an expectile-based objective

    Feb 10, 2026Shrey Rakeshkumar Patel, Sumedh Gupte, Soumen Pachal +2Reinforcement LearningRisk-Sensitive RL

  21. Reward Redistribution for CVaR MDPs using a Bellman Operator on L-infinity

    Feb 3, 2026Aneri Muni, Vincent Taboga, Esther Derman +2Markov Decision ProcessesQ-Learning

  22. Cantelli Constrained Policy Optimization

    Jan 30, 2026Rohan Tangri, Jan-Peter CalliessPolicy OptimizationConstrained RL

  23. ProSpec RL: Plan Ahead, then Execute

    Jul 31, 2024Liangliang Liu, Yi Guan, BoRan Wang +5Reinforcement LearningRisk-Sensitive RL

  24. On the Approximation and Convergence of Distributional Policy Gradient Algorithms for Risk-Sensitive Reinforcement Learning

    May 23, 2024Xian Yu, Minheng Xiao, Lei YingStochastic OptimizationDistributional RL