Reinforcement Learning

Also known as RL

Momentum

144 papers in the last four weeks, up 243% on the four weeks before. 1.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 1,138

All topics
CardsList
  1. Chain-of-Goals Hierarchical Policy for Long-Horizon Offline Goal-Conditioned RL

    Feb 3, 2026Jinwoo Choi, Sang-Hyun Lee, Seung-Woo SeoReinforcement LearningHierarchical RL

  2. VLM-Guided Experience Replay

    Feb 2, 2026Elad Sharony, Tom Jurgenson, Orr Krupnik +2Reinforcement LearningSample-Efficient RL

  3. Data- and Variance-dependent Regret Bounds for Online Tabular MDPs

    Feb 2, 2026Mingyi Li, Taira Tsuchiya, Kenji YamanishiRegret Minimization in RLMarkov Decision Processes

  4. Offline Reinforcement Learning of High-Quality Behaviors Under Robust Style Alignment

    Jan 30, 2026Mathieu Petitbois, Rémy Portelas, Sylvain LamprierReinforcement LearningOffline RL

  5. CLEANER: Self-Purified Trajectories Boost Agentic Reinforcement Learning

    Jan 21, 2026Tianshi Xu, Yuteng Chen, Meng LiAgentic RLReinforcement Learning

  6. Reinforcement Learning in the Real World: A Survey of Statistical Challenges and Future Directions

    Jan 21, 2026Asim H. Gazi, Yongyi Guo, Daiqi Gao +3Non-Stationary RLReinforcement Learning

  7. KAGE-Bench: Fast Known-Axis Visual Generalization Evaluation for Reinforcement Learning

    Jan 20, 2026Egor Cherepanov, Daniil Zelezetsky, Alexey K. Kovalev +1RL BenchmarksReinforcement Learning

  8. MemBuilder: Reinforcing LLMs for Long-Term Memory Construction via Attributed Dense Rewards

    Jan 9, 2026Zhiyu Shen, Ziming Wu, Fuming Lai +2Reinforcement LearningMemory-Augmented Language Models

  9. RL-AWB: Deep Reinforcement Learning for Auto White Balance Correction in Low-Light Night-time Scenes

    Jan 8, 2026Yuan-Kang Lee, Kuan-Lin Chen, Chia-Che Chang +1Image EnhancementReinforcement Learning

  10. Survival Dynamics of Neural and Programmatic Policies in Evolutionary Reinforcement Learning

    Jan 7, 2026Anton Roupassov-Ruiz, Yiyang ZuoReinforcement LearningArtificial Life

  11. Soft Fitted Q-Iteration without Bellman Completeness: Occupancy Reweighting and Temperature Annealing

    Dec 30, 2025Lars van der Laan, Nathan KallusReinforcement LearningKL-Regularized RL

  12. Trust Region Masking for Long-Horizon LLM Reinforcement Learning

    Dec 28, 2025Yingru Li, Jiacai Liu, Jiawei Xu +4RL for Language ModelsReinforcement Learning

  13. Meta-RL with Bayesian Linear Task Models

    Dec 24, 2025Jingyang You, Hanna KurniawatiRepresentation LearningReinforcement Learning

  14. The HydroGym Reinforcement Learning Platform for Fluid Dynamics

    Dec 19, 2025Christian Lagemann, Sajeda Mokbel, Miro Gondrum +18RL ControlRL Benchmarks

  15. Adaptive Partitioning and Learning for Stochastic Control of Diffusion Processes

    Dec 17, 2025Hanqing Jin, Renyuan Xu, Yanzhao YangRL ControlReinforcement Learning

  16. Achieving Olympiad-Level Geometry Large Language Model Agent via Complexity Boosting Reinforcement Learning

    Dec 11, 2025Haiteng Zhao, Junhao Shen, Yiming Zhang +7LLM AgentsReinforcement Learning

  17. Attention Trajectories as a Diagnostic Axis for Deep Reinforcement Learning

    Nov 25, 2025Charlotte Beylier, Hannah Selder, Arthur Fleig +2Reinforcement LearningInterpretability in RL

  18. Reinforcement Learning to Initialize Newton-Raphson for AC Power Flow with Quantum Annealing-Based Environment Updates

    Nov 25, 2025Zeynab Kaseb, Matthias Moller, Lindsay Spoor +4Reinforcement LearningQuantum Annealing

  19. SpatialThinker: Reinforcing Scene Graph-Grounded Spatial Reasoning via Dense Rewards

    Nov 10, 2025Hunar Batra, Haoqin Tu, Hardy Chen +3Visual Question AnsweringScene Graph Generation

  20. Reinforcement Learning for Long-Horizon Unordered Tasks: From Boolean to Coupled Reward Machines

    Oct 31, 2025Kristina Levina, Nikolaos Pappas, Athanasios Karapantelakis +2Reinforcement LearningQ-Learning

  21. A Game-Theoretic Spatio-Temporal Reinforcement Learning Framework for Collaborative Public Resource Allocation

    Oct 30, 2025Songxin Lei, Qiongyan Wang, Yanchen Zhu +6Multi-Agent CoordinationReinforcement Learning

  22. Zero-Human Demonstration End-to-end Autonomous Driving with Trajectory Scorer

    Oct 28, 2025Zhenxin Li, Nadine Chang, Wenhao Yao +9Reinforcement LearningEnd-to-End Autonomous Driving

  23. Learning to Reason Efficiently with Discounted Reinforcement Learning

    Oct 27, 2025Alex Ayoub, Kavosh Asadi, Dale Schuurmans +2Reinforcement LearningRL for Language Model Reasoning

  24. Consistent Zero-Shot Imitation with Contrastive Goal Inference

    Oct 20, 2025Kathryn Wantlin, Chongyi Zheng, Benjamin EysenbachContrastive LearningReinforcement Learning

  25. Pretraining in Actor-Critic Reinforcement Learning for Locomotion

    Oct 14, 2025Jiale Fan, Andrei Cramariuc, Tifanny Portela +1RL for RoboticsReinforcement Learning