Regret Minimization in RL

RL: Reinforcement Learning

Momentum

2 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 29

All topics
CardsList
  1. Reinforcement Learning with Segment Reward Feedback under Linear Function Approximation

    Oct 6, 2026Fengxu Liu, Siwei Wang, Gal Dalal +2Regret Minimization in RLReinforcement Learning

  2. Rate-Optimal Algorithm for Adversarial Linear CMDPs

    Oct 1, 2026Kihyun Yu, Honghao Wei, Dabeen LeeRegret Minimization in RLMarkov Decision Processes

  3. Learning Infinite-Horizon Average-Reward CMDPs via State Augmentation

    Sep 30, 2026Kihyun Yu, Seoungbin Bae, Dabeen LeeRegret Minimization in RLMarkov Decision Processes

  4. Decentralized Multi-Player Q-Learning in Episodic Markov Decision Processes with Information Asymmetry

    Aug 13, 2026Larissa Xu, King Bi, William ChangRegret Minimization in RLReinforcement Learning

  5. Finite Constant Frontiers and Auditable Regret Certificates for Average-Reward Reinforcement Learning

    Aug 7, 2026Ibne Farabi Shihab, Abu Sa-Adat Mohamed Moon-Im Al Ahsan, Md Najmus SwaqeebRegret Minimization in RLMarkov Decision Processes

  6. Convergence and Regret of the Policy Gradient for Multi-Armed Bandits in Diffusion Environment

    Jul 31, 2026Yanwei Jia, Du OuyangMulti-Armed BanditsRegret Minimization in RL

  7. A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics

    Jul 28, 2026Zheshun Wu, Renjie Zheng, Jinhang Zuo +2Non-Stationary RLRegret Minimization in RL

  8. Asymptotically Optimal Regret for Reinforcement Learning without Horizon Dependence

    Jul 22, 2026Runlong Zhou, Zihan Zhang, Maryam Fazel +1Regret Minimization in RLMarkov Decision Processes

  9. Policy Optimization Achieves Data-Dependent Regret Bounds in MDPs with Unknown Transitions

    Jun 30, 2026Mingyi Li, Taira Tsuchiya, Kenji YamanishiRegret Minimization in RLMarkov Decision Processes

  10. A Regret Minimization Framework on Preference Learning in Large Language Models

    Jun 8, 2026Suhwan Kim, Taehyun Cho, Geon-Hyeong Kim +4Regret Minimization in RLLLM Alignment

  11. Online KL-Regularized Reinforcement Learning with Function Approximation under Misspecification

    Jun 4, 2026Haoyang Hong, Zichen Wang, Quanquan Gu +1Regret Minimization in RLReinforcement Learning

  12. Minimax-Optimal Policy Regret in Partially Observable Markov Games

    Jun 1, 2026Raman AroraRegret Minimization in RLImperfect-Information Games

  13. Information-Directed Offline-to-Online Reinforcement Learning

    May 28, 2026Keru ChenRegret Minimization in RLBayesian RL

  14. Variance-Adaptive Optimal Algorithm for Reinforcement Learning with Multinomial Logit Function Approximation

    May 27, 2026Wonyoung Kim, Min-Hwan Oh, Garud Iyengar +1Regret Minimization in RLReinforcement Learning

  15. Learning Kernel-Based MDPs from Episodic Preferential Feedback

    May 22, 2026Nikola Pavlovic, Sattar Vakili, Qing ZhaoPairwise Preference LearningRegret Minimization in RL

  16. Minimax Optimal Variance-Aware Regret Bounds for Multinomial Logistic MDPs

    May 19, 2026Pierre Boudart, Pierre Gaillard, Alessandro RudiRegret Minimization in RLMarkov Decision Processes

  17. Tighter Regret Bounds for Contextual Action-Set Reinforcement Learning

    May 15, 2026Zijun Chen, Zihan ZhangRegret Minimization in RLReinforcement Learning

  18. Model-Based Reinforcement Learning with Double Oracle Efficiency in Policy Optimization and Offline Estimation

    May 1, 2026Haichen Hu, Jian Qian, David Simchi-LeviRegret Minimization in RLMarkov Decision Processes

  19. Wasserstein Distributionally Robust Regret Optimization for Reinforcement Learning from Human Feedback

    Apr 30, 2026Yikai Wang, Shang Liu, Jose BlanchetRegret Minimization in RLReinforcement Learning

  20. DARLING: Detection Augmented Reinforcement Learning with Non-Stationary Guarantees

    Apr 17, 2026Argyrios Gerogiannis, Yu-Han Huang, Venugopal V. VeeravalliNon-Stationary RLRegret Minimization in RL

  21. Posterior Sampling Reinforcement Learning with Gaussian Processes for Continuous Control: Sublinear Regret Bounds for Unbounded State Spaces

    Mar 9, 2026Hamish Flynn, Joe Watson, Ingmar Posner +1RL ControlRegret Minimization in RL

  22. Data- and Variance-dependent Regret Bounds for Online Tabular MDPs

    Feb 2, 2026Mingyi Li, Taira Tsuchiya, Kenji YamanishiRegret Minimization in RLMarkov Decision Processes

  23. Exploiting Exogenous Structure for Sample-Efficient Reinforcement Learning

    Sep 22, 2024Jia Wan, Sean R. Sinclair, Devavrat Shah +1Regret Minimization in RLMarkov Decision Processes

  24. Thompson Sampling for Infinite-Horizon Discounted Decision Processes

    May 14, 2024Daniel Adelman, Cagla Keceli, Alba V. Olivares-NadalThompson SamplingRegret Minimization in RL

  25. Safe Learning Under Irreversible Dynamics via Asking for Help

    Date pendingBenjamin Plaut, Juan Liévano-Karim, Hanlin Zhu +1Regret Minimization in RLReinforcement Learning