Continuous-Time RL

RL: Reinforcement Learning

Momentum

2 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 21

All topics
CardsList
  1. Learning to Solve Stochastic Controls with Unknown Drifts and Running Rewards: Theory, Algorithms and Convergence

    Sep 14, 2026Jin Ma, Gaozhan Wang, Jianfeng Zhang +1Reinforcement LearningStochastic Optimal Control

  2. Convergence and Regret of the Policy Gradient for Multi-Armed Bandits in Diffusion Environment

    Jul 31, 2026Yanwei Jia, Du OuyangMulti-Armed BanditsRegret Minimization in RL

  3. A Continuous-Time Reinforcement Learning Framework for Fine-Tuning Discrete Diffusion Models

    Jul 16, 2026Zikun Zhang, Jiayuan Sheng, David D. Yao +1Masked Diffusion ModelsRL for Language Model Reasoning

  4. Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies

    Jul 13, 2026Ziheng Cheng, Xin Guo, Huyên Pham +1Policy GradientContinuous-Time RL

  5. Entropy Regularization Improves Policy Robustness in Continuous-Time Reinforcement Learning

    Jul 3, 2026Jialun Cao, Fernando Acero, David Šiška +1Robust Markov Decision ProcessesMaximum Entropy RL

  6. Entropy-Regularized Reinforcement Learning for Linear-Quadratic Stackelberg Differential Games in Regime-Switching Diffusion Models

    Jun 27, 2026Congde Hu, Danping Li, Lin Xu +1Stackelberg GamesMaximum Entropy RL

  7. Mean-Field PhiBE: Continuous-Time Mean-Field Reinforcement Learning from Discrete-Time Data

    Jun 25, 2026Erhan Bayraktar, Martin Hernandez, Qinxin Yan +1Reinforcement LearningStochastic Optimal Control

  8. Continuous-time Optimal Stopping through Deep Reinforcement Learning

    Jun 16, 2026Cosmin Borsa, Michael LudkovskiQuantitative FinanceSequential Decision Making

  9. Deterministic Policy Gradient for Learning Equilibrium in Time-Inconsistent Control Problems

    Jun 10, 2026Xin Guo, Yijie Huang, Xiang YuPolicy GradientStochastic Optimal Control

  10. Policy Gradient for Continuous-Time Robust Markov Decision Processes

    Jun 3, 2026Tanya Veeravalli, David M. Bossens, Atsushi NitandaRobust Markov Decision ProcessesMarkov Decision Processes

  11. From Ticks to Flows: Dynamics of Neural Reinforcement Learning in Continuous Environments

    Jun 2, 2026Saket Tiwari, Tejas Kotwal, George KonidarisRL ControlReinforcement Learning

  12. Interaction-Limited Safe Continuous-Time RL for Dynamical Medical Treatment

    May 31, 2026Xun Shen, Yuepeng Wang, Akifumi Wachi +13Reinforcement LearningSequential Decision Making

  13. A Unified Benchmark for Dynamic Medical Treatment Reinforcement Learning

    May 31, 2026Yuepeng Wang, Ken Kawano, Yoshihiko Fujisawa +12RL BenchmarksReinforcement Learning

  14. Image AID via continuous-time reinforcement learning

    May 13, 2026Yilie Huang, Xun Yu ZhouDiffusion Model GuidanceMasked Diffusion Models

  15. Improved Model-based Reinforcement Learning with Smooth Kernels

    May 8, 2026Kun Long, Yuqiang Li, Xianyi WuReinforcement LearningContinuous-Time RL

  16. Operator-Guided Invariance Learning for Continuous Reinforcement Learning

    May 7, 2026Zuyuan Zhang, Fei Xu Yu, Tian LanReinforcement LearningContinuous-Time RL

  17. Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms

    Apr 30, 2026Zhenjie Ren, Xiaoli Wei, Xiang Yu +1Reinforcement LearningStochastic Optimal Control