Average-Reward RL

RL: Reinforcement Learning

Momentum

4 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 20

All topics
CardsList
  1. Average-Reward Reinforcement Learning for Multichain MDPs: A Hierarchical Decomposition Approach

    Oct 7, 2026Huizhen Yu, Isaiah HeidtMarkov Decision ProcessesAverage-Reward RL

  2. Learning Infinite-Horizon Average-Reward CMDPs via State Augmentation

    Sep 30, 2026Kihyun Yu, Seoungbin Bae, Dabeen LeeRegret Minimization in RLMarkov Decision Processes

  3. A Concentration Bound for Two-Timescale Actor-Critic Algorithm

    Sep 24, 2026Prashansa Panda, Shalabh BhatnagarAverage-Reward RLTwo-Timescale Stochastic Approximation

  4. Vector Bellman Theory for Multichain Robust Average-Reward Markov Decision Processes

    Sep 23, 2026Yue Wang, George AtiaRobust Markov Decision ProcessesMarkov Decision Processes

  5. Finite Constant Frontiers and Auditable Regret Certificates for Average-Reward Reinforcement Learning

    Aug 7, 2026Ibne Farabi Shihab, Abu Sa-Adat Mohamed Moon-Im Al Ahsan, Md Najmus SwaqeebRegret Minimization in RLMarkov Decision Processes

  6. Robust Average-Reward Markov Decision Processes: Minimax-Optimal Learning via Plug-in Reductions

    Aug 6, 2026Yuepeng Yang, Yuxin Chen, Yuejie ChiRobust Markov Decision ProcessesAverage-Reward RL

  7. Hierarchical Multilevel Monte Carlo for Order-Optimal Neural Actor-Critic in Average-Reward CMDPs

    Jul 30, 2026Ankur Naskar, Vaneet AggarwalAverage-Reward RLConstrained RL

  8. Bias-Controlled Primal-Dual Natural Actor-Critic: Optimal Rates for Constrained Multi-Objective Average-Reward RL

    Jun 23, 2026Ankur Naskar, Swetha Ganesh, Vaneet AggarwalMulti-Objective Reinforcement LearningReinforcement Learning

  9. Maximum Entropy Inverse Reinforcement Learning for Mean-Field Games with Average Reward

    Jun 15, 2026Şevket Kaan Alkır, Naci Saldı, Berkay Anahtarcı +1Reinforcement LearningAverage-Reward RL

  10. Learning Policy from a Single Trajectory in Average-Reward Markov Decision Process

    Jun 15, 2026Jongmin Lee, Ernest K. Ryu, Vaneet AggarwalMarkov Decision ProcessesReinforcement Learning

  11. Lyapunov-Based Sample Complexity Analysis for Weakly-Coupled MDPs

    Jun 12, 2026Tianhao Wu, Matthew Zurek, Weina Wang +1Multi-Armed BanditsRobust Markov Decision Processes

  12. Quotient-Categorical Representations for Bellman-Compatible Average-Reward Distributional Reinforcement Learning

    May 11, 2026Ege C. Kaya, Aliasghar Pourghani, Vijay Gupta +1Distributional RLReinforcement Learning

  13. On the Divergence of Differential Temporal Difference Learning without Local Clocks

    May 7, 2026David Antrobius, Shangtong ZhangReinforcement LearningAverage-Reward RL

  14. A Harmonic Mean Formulation of Average Reward Reinforcement Learning in SMDPs

    May 6, 2026Erel Shtossel, Alicia Vidler, Uri Shaham +1Non-Stationary RLReinforcement Learning

  15. Bridging the Gap Between Average and Discounted TD Learning

    May 3, 2026Haoxing Tian, Zaiwei Chen, Ioannis Ch. Paschalidis +1Reinforcement LearningAverage-Reward RL

  16. Distributionally Robust Markov Games with Average Reward

    Aug 5, 2025Zachary Roch, Yue WangNash EquilibriumMulti-Agent System Optimization

  17. Efficient Q-Learning and Actor-Critic Methods for Robust Average-Reward Reinforcement Learning

    Jun 8, 2025Yang Xu, Swetha Ganesh, Vaneet AggarwalRobust Markov Decision ProcessesReinforcement Learning

  18. Model-Free Robust Average-Reward Reinforcement Learning with Sample Complexity Analysis

    May 18, 2025Zachary Roch, George Atia, Yue WangReinforcement LearningAverage-Reward RL