Risk-Sensitive RL

RL: Reinforcement Learning

Momentum

10 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 58

All topics
CardsList
  1. Safe Meta-Policy Design with Risk Control

    Oct 7, 2026Wenbin Zhou, Michael Lingzhi Li, Shixiang ZhuSafe RLRisk-Sensitive RL

  2. Safe on Average, Unsafe in the Tail: When Is the Episodic-Cost Tail Controllable?

    Oct 7, 2026Samuel Tetteh, Cody FlemingSafe RLConstrained RL

  3. Variance-Averse nn-Step Offline Reinforcement Learning for Sparse Long-Horizon Environments

    Oct 6, 2026Guhyeon Kang, Minhae KwonDistributional RLRisk-Sensitive RL

  4. Risk-Sensitive Crowd Navigation with Adaptive Ellipsoidal Conformal Prediction

    Oct 5, 2026Ruihan A. Li, Ziyao Guo, Yingying LiDistribution Shift RobustnessRobot Navigation

  5. PPO-HRAP: Proximal Policy Optimization with a Hybrid Regime-Aware Policy for Risk-Controlled Trading

    Oct 1, 2026Duong Hien Chi Kien, Thanh Trung HuynhReinforcement LearningRisk-Sensitive RL

  6. Exploring More, Reasoning Better: Stepwise Risk-Sensitive GRPO for Diffusion Language Models

    Sep 30, 2026Yue YU, Bowen Zuo, David Crandall +2RL for Language Model ReasoningGroup Relative Policy Optimization

  7. Robust Risk-Sensitive Reinforcement Learning from Corrupted Human Feedback

    Sep 30, 2026Xinyi Ni, Lifeng LaiRisk-Sensitive RLRobust RL

  8. Character Training for Risk-Averse Agents

    Sep 29, 2026Arav Dhoot, Punya Syon Pandey, Jamie Johnson +3Risk-Sensitive RLAI Agent Safety

  9. RSD-Poker: Structure-Adaptive and Shift-Robust Risk-Utility Certification for Residual Policies in Imperfect-Information Games

    Sep 27, 2026Miaobo Hu, Shuhao Hu, Xiaobo Guo +5Distribution Shift RobustnessImperfect-Information Games

  10. Robust Adversarial Reinforcement Learning with Risk Sensitivity and Critic Consistency Regularization

    Sep 23, 2026Jiaxi Wu, Tiantian Zhang, Yuxing Wang +2Reinforcement LearningRisk-Sensitive RL

  11. Certifying Lower Bounds for Risk-Sensitive Reinforcement Learning under Adversarial State Perturbations

    Sep 11, 2026Tong Li, Saunak Kumar Panda, Yisha XiangRisk-Sensitive RLAdversarial Perturbations

  12. A Risk-Sensitive and Uncertainty-Aware Decision-Making and Control Framework for Safe and Robust Autonomous Driving

    Sep 9, 2026Zhuoren Li, Ran Yu, Weiqi Zhang +4Control Barrier FunctionsAutonomous Driving

  13. Risk-Conditioned Fine-Tuning of Large Language Models

    Sep 8, 2026Zixuan Liu, Fangzheng Wu, Brian Summa +1Risk-Sensitive RLLLM Safety

  14. Mini-Batch Risk-Averse Deep Q-Learning: A Robot Navigation Case Study

    Sep 7, 2026Aayush Patel, Andrzej RuszczyńskiDeep Q-LearningRobot Navigation

  15. Risk and Anomaly Identification for Distribution Network Optimal Operation Based on Reinforcement Learning and Uncertainty Quantification

    Sep 3, 2026Ziqi ZhangRisk-Sensitive RLOOD Detection

  16. Tail-Likelihood Reinforcement Learning

    Sep 2, 2026Shrinivas Ramasubramanian, Daman Arora, Fahim Tajwar +11Risk-Sensitive RLRL for Generative Models

  17. Adaptive Finite-Budget Training for CVaR Risk-Aware Q-Learning

    Aug 5, 2026Yifan Wu, Junjie Lei, Wenjie HuangReinforcement LearningQ-Learning

  18. Taming the Implicit: Dual-Channel Risk-Aware Reinforcement Fine-Tuning for Continual Multimodal Post-Training

    Aug 4, 2026Yibei Liu, Jiajun Chen, Qianle Zhang +4Multimodal Large Language ModelsRisk-Sensitive RL

  19. Finite-Time Analysis of Discounted Exponential-Utility Reinforcement Learning

    Aug 3, 2026Ankur Naskar, Vivek T A, Aditya Kumar +2Reinforcement LearningRisk-Sensitive RL

  20. Efficient Heteroscedastic Bayesian Optimization for Risk-Aware AutoRL

    Jul 29, 2026Mingxuan Che, Tsung-Yuan Tseng, Theresa Eimer +2Bayesian OptimizationRisk-Sensitive RL

  21. Anticipatory Risk-Guided Reinforcement Learning for Safe Flight Through Dynamic Clutter

    Jul 26, 2026Yuchao Mei, Guohao Zhang, Luxia Ai +2Collision AvoidanceRisk-Sensitive RL

  22. Online Policy Evaluation for MDPs with Dynamic UBSR Measures

    Jul 25, 2026Weikai Wang, Erick DelagePolicy EvaluationRisk-Sensitive RL

  23. Long-Term Sequential Decision Making under Risk

    Jul 22, 2026Irmaan, Mirzanejad, Nadjet Bourdache +1Markov Decision ProcessesDynamic Programming

  24. Learning from World Feedback: Why Model Uncertainty Fails as a Risk Signal in Model-Based RL

    Jul 18, 2026Zhaohui WangRisk-Sensitive RLModel Predictive Control

  25. A Noise-Robust Elicit-to-Optimize Framework for Distortion Riskmetrics via Inverse Reinforcement Learning

    Jul 15, 2026Yang Liu, Yuhao Liu, Yunran WeiReinforcement LearningRisk-Sensitive RL

  26. SteinGate: Tail-Sensitive Safe Reinforcement Learning via Stein Discrepancy

    Jul 14, 2026Yassine Chemingui, Chenhua Fan, Honghao Wei +1Constrained RLRisk-Sensitive RL

  27. Risk-Aware General-Utility Markov Decision Processes

    Jul 10, 2026Pedro P. Santos, Fábio Vital, Alberto Sardinha +1Markov Decision ProcessesMarkov Models

  28. Deep Reinforcement Learning for Reliability Based Bi-Objective Portfolio Optimization

    Jul 7, 2026Sounaq Das, Tanmay Sen, Raghu Nandan Sengupta +1Multi-Objective Reinforcement LearningRisk-Sensitive RL

  29. Utility-Constrained Policy Optimization

    Jun 12, 2026Mehrdad Moghimi, Bernardo Avila PiresConstrained RLRisk-Sensitive RL

  30. Safety-Contract Graph Multi-Agent Reinforcement Learning for Autonomous Network Security Response

    Jun 11, 2026Jose Luis Lima de Jesus SilvaAutonomous Cyber DefenseRisk-Sensitive RL

  31. Uncertainty-Aware and Temporally Regulated Expert Advice in Reinforcement Learning for Autonomous Driving

    May 28, 2026Ahmed Abouelazm, Felix Klingebiel, Philip Schörner +1Reinforcement LearningRisk-Sensitive RL

  32. Evolving Robustness--Exploration Trade-off in Online Reinforcement Learning via Quantile Bayesian Risk MDPs

    May 23, 2026Meichen Song, Yuhao Wang, Enlu ZhouReinforcement LearningBayesian RL

  33. On the Sample Complexity of Discounted Reinforcement Learning with Optimized Certainty Equivalents

    May 20, 2026Oliver Mortensen, Mohammad Sadegh TalebiReinforcement LearningRisk-Sensitive RL

  34. DiffCVaR: Reinforcement Learning for Risk Adaptation via Differentiable CVaR Barrier Functions

    May 20, 2026Xinyi Wang, Taekyung Kim, Bardh Hoxha +2Control Barrier FunctionsRisk-Sensitive RL

  35. SafeAlign-VLA: A Negative-Enhanced Safe Alignment Framework for Risk-Aware Autonomous Driving

    May 19, 2026Kefei Tian, Yuansheng Lian, Kai Yang +2End-to-End Autonomous DrivingRisk-Sensitive RL

  36. Action-Conditioned Risk Gating for Safety-Critical Control under Partial Observability

    May 14, 2026Yushen Liu, Yin-Jen Chen, Ziyi Chen +4Safety-Critical ControlPartially Observable RL

  37. Safety-Constrained Reinforcement Learning with Post-Training Reachability Verification for Robot Navigation

    May 13, 2026Qisong He, Xinmiao Huang, Jinwei Hu +4Constrained RLRisk-Sensitive RL

  38. Tight Sample Complexity Bounds for Entropic Best Policy Identification

    May 13, 2026Amer Essakine, Claire VernadeReinforcement LearningRisk-Sensitive RL

  39. Reinforcement Learning for Exponential Utility: Algorithms and Convergence in Discounted MDPs

    May 8, 2026Gugan Thoppe, L. A. Prashanth, Ankur Naskar +1Markov Decision ProcessesReinforcement Learning

  40. Actor-Critic Algorithm for Dynamic Expectile and CVaR

    May 8, 2026Yudong Luo, Erick DelageReinforcement LearningRisk-Sensitive RL

  41. Learning Material-Aware Hamiltonian Risk Fields for Safe Navigation

    May 7, 2026Aditya Sai Ellendula, Yi Wang, Chandrajit BajajCollision AvoidanceDynamical Systems

  42. Quantile Geometry Regularization for Distributional Reinforcement Learning

    May 5, 2026Zhaofan Zhang, Minghao Yang, Rufeng Chen +2Distributional RLQuantile Regression

  43. MARS-DA: A Hierarchical Reinforcement Learning Framework for Risk-Aware Multi-Agent Bidding in Power Grids

    May 4, 2026Jiayi Chen, Xuan Zhang, Guiling WangHierarchical RLRisk-Sensitive RL

  44. Reinforcement Learning with Markov Risk Measures and Multipattern Risk Approximation

    May 1, 2026Andrzej Ruszczynski, Tiangang ZhangMarkov Decision ProcessesReinforcement Learning

  45. Frictive Policy Optimization for LLMs: Epistemic Intervention, Risk-Sensitive Control, and Reflective Alignment

    Apr 28, 2026James Pustejovsky, Nikhil KrishnaswamyRL for Language ModelsLanguage Model Safety Evaluation

  46. The Price of Paranoia: Robust Risk-Sensitive Cooperation in Non-Stationary Multi-Agent Reinforcement Learning

    Apr 17, 2026Deep Kumar Ganguly, Chandradithya S Jonnalagadda, Pratham Chintamani +1Cooperative Game TheoryMulti-Agent Coordination

  47. Safe RLHF Beyond Expectation: Stochastic Dominance for Universal Spectral Risk Control

    Mar 11, 2026Yaswanth Chittepu, Ativ Joshi, Rajarshi Bhattacharjee +1Constrained RLLLM Safety Alignment

  48. Reinforcement learning with an expectile-based objective

    Feb 10, 2026Shrey Rakeshkumar Patel, Sumedh Gupte, Soumen Pachal +2Reinforcement LearningRisk-Sensitive RL

  49. Reward Redistribution for CVaR MDPs using a Bellman Operator on L-infinity

    Feb 3, 2026Aneri Muni, Vincent Taboga, Esther Derman +2Markov Decision ProcessesQ-Learning

  50. Cantelli Constrained Policy Optimization

    Jan 30, 2026Rohan Tangri, Jan-Peter CalliessPolicy OptimizationConstrained RL

  51. ProSpec RL: Plan Ahead, then Execute

    Jul 31, 2024Liangliang Liu, Yi Guan, BoRan Wang +5Reinforcement LearningRisk-Sensitive RL

  52. On the Approximation and Convergence of Distributional Policy Gradient Algorithms for Risk-Sensitive Reinforcement Learning

    May 23, 2024Xian Yu, Minheng Xiao, Lei YingStochastic OptimizationDistributional RL