Reinforcement Learning

Also known as RL

Momentum

144 papers in the last four weeks, up 243% on the four weeks before. 1.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 1,138

All topics
CardsList
  1. On Gaussian approximation for entropy-regularized Q-learning with function approximation

    May 17, 2026Artemy Rubtsov, Rahul Singh, Eric Moulines +2Reinforcement LearningStochastic Approximation

  2. ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks

    May 17, 2026Tianxiang Xu, Xiaoyan Zhu, Xin Lai +1Reward ModelingReinforcement Learning

  3. Deep Reinforcement Learning Framework for Diversified Portfolio Management Across Global Equity Markets

    May 17, 2026Kamil Kashif, Robert ŚlepaczukReinforcement LearningPortfolio Optimization

  4. DISA: Offline Importance Sampling for Distribution-Matching LLM-RL

    May 17, 2026Shaobo Wang, Yujie Chen, Yafeng Sun +9Reinforcement LearningRL for Language Model Reasoning

  5. The Unlearnability Phenomenon in RLVR for Language Models

    May 16, 2026Yulin Chen, He He, Chen ZhaoReinforcement LearningRL for Language Model Reasoning

  6. Emergence of a Flow-Assisted Casting Strategy for Olfactory Navigation via Memory-Augmented Reinforcement Learning

    May 16, 2026Changxu Zhao, Dongxiao Zhao, Xin Bian +1Reinforcement LearningRobot Navigation

  7. Learn Where Outcomes Diverge: Efficient VLA RL via Probabilistic Chunk Masking

    May 15, 2026Vaidehi Bagaria, Nikshep Grampurohit, Pulkit VermaReinforcement LearningNeural Network Optimization

  8. Mind Dreamer: Untethering Imagination via Active Causal Intervention on Latent Manifolds

    May 15, 2026Shaojun Xu, Xiaoling Zhou, Yihan Lin +4Reinforcement LearningCredit Assignment in RL

  9. Tighter Regret Bounds for Contextual Action-Set Reinforcement Learning

    May 15, 2026Zijun Chen, Zihan ZhangRegret Minimization in RLReinforcement Learning

  10. AstraFlow: Dataflow-Oriented Reinforcement Learning for Agentic LLMs

    May 15, 2026Haizhong Zheng, Yizhuo Di, Jiahui Wang +7Agentic RLReinforcement Learning

  11. Terrain Consistent Reference-Guided RL for Humanoid Navigation Autonomy

    May 15, 2026William D. Compton, Zachary Olkin, Aaron D. AmesHumanoid Robot LocomotionReinforcement Learning

  12. Second-Order Actor-Critic Methods for Discounted MDPs via Policy Hessian Decomposition

    May 14, 2026Sanjeev Manivannan, Shuban VReinforcement LearningPolicy Gradient Methods

  13. Critic-Driven Voronoi-Quantization for Distilling Deep RL Policies to Explainable Models

    May 14, 2026Senne Deproost, Denis Steckelmacher, Ann NowéReinforcement LearningVector Quantization

  14. CaMeRL: Collision-Aware and Memory-Enhanced Reinforcement Learning for UAV Navigation in Multi-Scale Obstacle Environments

    May 14, 2026Hong Hong, Feiyu Liao, Yongheng Liang +3RL for RoboticsReinforcement Learning

  15. DRL-STAF: A Deep Reinforcement Learning Framework for State-Aware Forecasting of Complex Multivariate Hidden Markov Processes

    May 14, 2026Manrui Jiang, Jingru Huang, Yong Chen +1Multivariate Time Series ForecastingReinforcement Learning

  16. Fast Rates for Inverse Reinforcement Learning

    May 14, 2026Andreas Schlaginhaufen, Maryam KamgarpourReinforcement LearningStatistical Learning Theory

  17. Angel or Demon: Investigating the Plasticity Interventions' Impact on Backdoor Threats in Deep Reinforcement Learning

    May 14, 2026Oubo Ma, Ruixiao Lin, Yang Dai +4Reinforcement LearningBackdoor Attacks

  18. Fully Dynamic Rebalancing in Dockless Bike-Sharing Systems via Deep Reinforcement Learning

    May 14, 2026Edoardo Scarpel, Alberto Pettena, Matteo Cederle +3RL ControlReinforcement Learning

  19. ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization

    May 14, 2026Letian Yang, Xu Liu, Yiqiang Lu +3Reinforcement LearningOffline-To-Online RL

  20. Reinforcement Learning with Semantic Rewards Enables Low-Resource Language Expansion without Alignment Tax

    May 14, 2026Zeli Su, Ziyin Zhang, Zhou Liu +7Reinforcement LearningLow-Resource MT

  21. Matrix-Space Reinforcement Learning for Reusing Local Transition Geometry

    May 14, 2026Zuyuan Zhang, Carlee Joe-Wong, Tian LanReinforcement LearningTrajectory Representation Learning