Reinforcement Learning

Also known as RL

Momentum

144 papers in the last four weeks, up 243% on the four weeks before. 1.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 1,138

All topics
CardsList
  1. Temporally Interpretable Differentiable Decision Trees

    Oct 7, 2026Eisuke Hirota, Aarav Sane, Rohan PalejaInterpretable MLInterpretability in RL

  2. RollVerify: Bridging Efficiency and Accuracy in Long-Tail Rollout Reinforcement Learning

    Oct 7, 2026Yongqiang Yao, Jinru Tan, Kaihuan Liang +5RL for Language ModelsReinforcement Learning

  3. CERO: Where and When to Allocate Rollouts for RL Post-Training

    Oct 7, 2026Yiming Zong, Yige Wang, Xing Hu +2Reinforcement LearningRL Post-Training

  4. AGAR: a reinforcement learning substrate for LLM program evolution

    Oct 6, 2026Haoran Li, Zengle Ge, Xiaomin Yuan +11LLM-Based Program SynthesisRL for Code Generation

  5. Convex-Concave Reinforcement Learning

    Oct 6, 2026Shripad V. Deshmukh, Yaswanth Chittepu, Dhawal Gupta +2Reinforcement LearningPolicy Gradient Methods

  6. LASER: Latent Space Adjoint Matching for Support-Constrained Entropy-Regularized Offline RL

    Oct 6, 2026Songyuan Zhang, Oswin So, Eric Yang Yu +3Reinforcement LearningOffline RL

  7. Selective Transfer of RL Updates for Visual Reasoning

    Oct 6, 2026Suxin Ji, Hungtao Wan, Mingjun Liu +1Reinforcement LearningVLM Reasoning

  8. Reinforcement Learning with Segment Reward Feedback under Linear Function Approximation

    Oct 6, 2026Fengxu Liu, Siwei Wang, Gal Dalal +2Regret Minimization in RLReinforcement Learning

  9. Revisiting Temporal Regularization for Smooth Control in Deep Reinforcement Learning

    Oct 6, 2026SungJae Ahn, Jeong Woon Lee, Kyoleen Kwak +1RL ControlReinforcement Learning

  10. Learned Adaptive Multiresolution Diffusion Imaging

    Oct 6, 2026Christian Tantardini, Stig Rune Jensen, Roberto Di Remigio Eikås +1Reinforcement LearningAdaptive Mesh Refinement

  11. Considering Context: When World Models Need Context Encoders

    Oct 5, 2026Oleg Smirnov, Sofiane Ennadir, John Pertoft +2Reinforcement LearningWorld Model Learning

  12. GPlaceRL: An Open-Source Graph Reinforcement Learning Framework for Detailed Placement

    Oct 5, 2026Pavlos Stoikos, Foteini Oikonomou, Christos Poulos +5Reinforcement LearningElectronic Design Automation

  13. I-BFM: Reward-Conditioned Robust Humanoid Interaction via Unsupervised Reinforcement Learning

    Oct 5, 2026Ziqi Han, Yitang Li, Junhan Sun +8Representation LearningReinforcement Learning

  14. HuatuoGPT-3: RL-Only Domain Adaptation from Base Models

    Oct 5, 2026Junying Chen, Xinyuan Xie, Ziniu Li +7RL for Language ModelsReinforcement Learning

  15. An LLM-in-the-loop RL Framework for Bioinformatics Feature Selection

    Oct 4, 2026Xinyuan Wang, Deepti Agrawal, Yanjie FuReinforcement LearningLLM-Guided RL

  16. Factoriax: A GPU-Accelerated Factorio-Style Simulator for Reinforcement Learning

    Oct 4, 2026Mickey Beurskens, Tristan Tomilin, Thiago D. SimãoRL BenchmarksReinforcement Learning

  17. Hierarchical Reinforcement Learning with Stable Temporal Abstraction for Language Model Agents

    Oct 4, 2026Shayan Mohajer Hamidi, Yize Cheng, Yuanda Xu +2Reinforcement LearningHierarchical RL

  18. Task Inference Beyond Least Squares in Behavioral Foundation Models

    Oct 4, 2026Kuan-Hsun Tu, Chien-Sheng Chiang, Hsin-Wei Chen +2Reinforcement LearningMulti-Task RL

  19. On Semi-Markov Suboptimality in Hierarchical Reinforcement Learning

    Oct 4, 2026Bingyun Liu, Yuheng JingReinforcement LearningSequential Decision Making

  20. Long-MDR: Long-Context Reinforcement Learning for Multimodal Deep-Research Agents

    Oct 4, 2026On Tai TangReinforcement LearningDeep Research Agents

  21. Beyond Instruction Following: Learning Grounded Skill-Following with Skill Contracts

    Oct 4, 2026Jianghan Shen, Zhenjie Liu, Yue Li +10Reinforcement LearningLLM Agent Skill Learning

  22. Direction-Conditioned Policies for Online Goal-Conditioned Reinforcement Learning

    Oct 4, 2026S K Swaminathan, Damiya Gondha, Theyanesh Eswaramoorthy Rajahkrishnan +1Reinforcement LearningContrastive RL

  23. Faynt: Scaling and Optimizing Policies for Competitive Melee

    Oct 1, 2026Ali Janati, Nikita Kuzmin, Rohit Swamy +1Reinforcement LearningSelf-Play RL

  24. Bellman Meets Lyapunov: Unsupervised Reinforcement Learning via Mastering Chaos

    Oct 1, 2026Tristan Shah, Wooyoung Chung, Volodomyr Makarenko +2Reinforcement LearningIntrinsic Motivation