Distributionally Robust RL

RL: Reinforcement Learning

Momentum

3 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 21

All topics
CardsList
  1. RSD-Poker: Structure-Adaptive and Shift-Robust Risk-Utility Certification for Residual Policies in Imperfect-Information Games

    Sep 27, 2026Miaobo Hu, Shuhao Hu, Xiaobo Guo +5Distribution Shift RobustnessImperfect-Information Games

  2. Statistical Convergence of Transformer Encoder-Accelerated Robust Reinforcement Learning

    Sep 20, 2026Suman Banerjee, Hiroyasu TsukamotoReinforcement LearningTransformer-Based RL

  3. Online Robust Reinforcement Learning Through Monte-Carlo Planning

    Sep 16, 2026Tuan Dam, Kishan Panaganti, Brahim Driss +1Monte Carlo Tree SearchDistributionally Robust RL

  4. Robust Average-Reward Markov Decision Processes: Minimax-Optimal Learning via Plug-in Reductions

    Aug 6, 2026Yuepeng Yang, Yuxin Chen, Yuejie ChiRobust Markov Decision ProcessesAverage-Reward RL

  5. Entropy Regularization Improves Policy Robustness in Continuous-Time Reinforcement Learning

    Jul 3, 2026Jialun Cao, Fernando Acero, David Šiška +1Robust Markov Decision ProcessesMaximum Entropy RL

  6. Stationary Robust Mean-Field Games under Model Mismatches

    Jun 21, 2026Yue WangMean Field GamesGame Theory

  7. Robust QQ-learning for mean-field control under Wasserstein uncertainty in common noise

    Jun 18, 2026Mathieu Laurière, Ariel Neufeld, Kyunghyun ParkQ-LearningWasserstein Distributionally Robust Optimization

  8. A Unifying Lens on Reward Uncertainty in RLHF

    Jun 8, 2026Ely Hahami, Yoel Zimmermann, Ray Zhou +1Reward ModelingKL-Regularized RL

  9. Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling

    May 14, 2026Nicholas E. Corrado, Wenyuan Huang, Josiah P. HannaDistributionally Robust RLMulti-Task RL

  10. Central Limit Theorem for Two-Time-Scale Approximate Distributionally Robust RL

    May 8, 2026Shengbo Wang, Zexi ZhangStochastic ApproximationDistributionally Robust RL

  11. Quantile Geometry Regularization for Distributional Reinforcement Learning

    May 5, 2026Zhaofan Zhang, Minghao Yang, Rufeng Chen +2Distributional RLQuantile Regression

  12. Taming the Curses of Multiagency in Robust Markov Games with Large State Space through Linear Function Approximation

    May 4, 2026Jingchu Gai, Laixi ShiMulti-Agent System OptimizationMarkov Models

  13. Wasserstein Distributionally Robust Regret Optimization for Reinforcement Learning from Human Feedback

    Apr 30, 2026Yikai Wang, Shang Liu, Jose BlanchetRegret Minimization in RLReinforcement Learning

  14. A Distributionally Robust Reinforcement Learning Framework for Constrained Urban EV Dispatch

    Apr 28, 2026An Nguyen, Hoang Nguyen, Phuong Le +3Electric Vehicle ChargingConstrained RL

  15. Finite-Time Convergence of Single-Trajectory Chi-Square Robust Q-Learning With Linear Function Approximation

    Oct 2, 2025Saptarshi Mandal, Yashaswini Murthy, R. SrikantQ-LearningDistributionally Robust RL

  16. Distributionally Robust Markov Games with Average Reward

    Aug 5, 2025Zachary Roch, Yue WangNash EquilibriumMulti-Agent System Optimization

  17. Efficient Q-Learning and Actor-Critic Methods for Robust Average-Reward Reinforcement Learning

    Jun 8, 2025Yang Xu, Swetha Ganesh, Vaneet AggarwalRobust Markov Decision ProcessesReinforcement Learning

  18. Distributionally Robust Deep Q-Learning

    May 25, 2025Chung I Lu, Julian Sester, Aijia ZhangRobust Markov Decision ProcessesDeep Q-Learning

  19. Model-Free Robust Average-Reward Reinforcement Learning with Sample Complexity Analysis

    May 18, 2025Zachary Roch, George Atia, Yue WangReinforcement LearningAverage-Reward RL

  20. Distributionally Robust Reinforcement Learning with Human Feedback

    Mar 1, 2025Debmalya Mandal, Paulius Sasnauskas, Goran RadanovicDirect Preference OptimizationLLM Fine-Tuning

  21. Distributionally Robust Reinforcement Learning with Interactive Data Collection: Fundamental Hardness and Near-Optimal Algorithms

    Apr 4, 2024Miao Lu, Han Zhong, Tong Zhang +1Distributionally Robust RLRobust RL