Reinforcement Learning

Also known as RL

Momentum

144 papers in the last four weeks, up 243% on the four weeks before. 1.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 1,138

All topics
CardsList
  1. CLaC@FinMMEval 2026 Task 3: Sentiment-Augmented Deep Reinforcement Learning for Active Trading -- An Alpha-Reward Approach

    Jul 17, 2026Andrei Neagu, Eeham Khan, Leila KosseimReinforcement LearningDeep Q-Learning

  2. RAVEN: Reinforcement-Adaptive Visibility-Graph Planning for Robust Humanoid Navigation with Collision-Free MPC

    Jul 17, 2026Ruochen Hou, Shiqi Wang, Beom Jun Kim +3Reinforcement LearningRobot Navigation

  3. Process Reward Informed Tree Rollout for Effective Multi-Turn RL

    Jul 17, 2026Xintong Li, Sha Li, Yuwei Zhang +8Reinforcement LearningRL Exploration

  4. Evaluating covariate balance for long time horizon Markov decision processes

    Jul 16, 2026Joshua Spear, Rebecca Pope, Neil J SebireCausal Effect EstimationReinforcement Learning

  5. 3D Geometric Tooth Alignment Planning via Deep Reinforcement Learning

    Jul 16, 2026Yong Li, Jianwen Lou, Jiayue Ma +3Reinforcement LearningHealthcare

  6. An offline approach to fNIRS-guided reinforcement learning for robot behavior

    Jul 15, 2026Julia Santaniello, Madelaine Brower, Benson Jiang +3Reinforcement LearningRobot Learning

  7. A Noise-Robust Elicit-to-Optimize Framework for Distortion Riskmetrics via Inverse Reinforcement Learning

    Jul 15, 2026Yang Liu, Yuhao Liu, Yunran WeiReinforcement LearningRisk-Sensitive RL

  8. Lighthouse RL: Sample-Efficient Circuit Optimization via Strategic Reset Points

    Jul 15, 2026Mustafa Emre Gürsoy, Stefan Uhlich, Ryoga Matsuo +6Reinforcement LearningBlack-Box Optimization

  9. DAGR: State-Conditioned Goal Representations via Difference-Aware Goal Cross-Attention

    Jul 15, 2026Xing Lei, Wenyan Yang, Xuetao Zhang +1Reinforcement LearningAttention Mechanisms

  10. Branching Policy Optimization: Sandbox-Native Language Agent Reinforcement Learning

    Jul 15, 2026Bowei He, Yankai Chen, Xiaokun Zhang +1Reinforcement LearningPolicy Gradient Methods

  11. GFlowRL: Scaling Distribution-Matching RL to Large Language Models

    Jul 15, 2026Xiaodong Liu, Michael Xu, Jack W. Stokes +3RL for Code GenerationReinforcement Learning

  12. Deconstructing Actor-Critic: A Large-scale Empirical Study of Design Components for Practitioners

    Jul 14, 2026Haseeb Shah, Lingwei Zhu, Adam White +1RL ControlReinforcement Learning

  13. Knowledge- and Gradient-Guided Reinforcement Learning for Parametrized Action Markov Decision Processes

    Jul 14, 2026Jonas Ehrhardt, René Heesch, Oliver NiggemannReinforcement LearningConstrained RL

  14. Vision-Based Dribbling for Humanoid Soccer via Privileged Representation Learning

    Jul 14, 2026Flavio Maiorana, Valerio Spagnoli, Eugenio Bugli +5RL for RoboticsReinforcement Learning

  15. Robust In-Hand Manipulation via Priors in Reinforcement Learning and Mechanical Design

    Jul 13, 2026Yifei Chen, Shihan Lu, Ed Colgate +1Robotic Hand DesignRobotic Grasping

  16. SKooP: Symmetric Koopman Predictions for Faster and More Generalizable Legged Robot Locomotion with Reinforcement Learning

    Jul 13, 2026Evelyn D'Elia, Weishu Zhan, Giulio Turrisi +5Reinforcement LearningKoopman Operator Learning

  17. SETA: Scaling Environments for Terminal Agents

    Jul 12, 2026Qijia Shen, Zhiqi Huang, Vamsidhar Kamanuru +19Reinforcement LearningTerminal Agents

  18. Predictive Divergence Masks for LLM RL

    Jul 12, 2026Xiangxin Zhou, Jiarui Yao, Penghui Qi +4RL for Language ModelsReinforcement Learning

  19. Q-Learning Lab: Teaching Reinforcement Learning Through Learner-Generated Trace Analysis

    Jul 12, 2026Ekkachai JuengReinforcement LearningQ-Learning

  20. Calibration-First Reward-Component Auditing for Reinforcement Learning Control in Smart Greenhouses

    Jul 12, 2026Yuhui Bie, Guowei Xu, Yaojun WangRL ControlReinforcement Learning

  21. ARMOR: Stabilizing On-Policy LLM RL with Off-Policy Anchor Samples

    Jul 11, 2026Kexin Huang, Junkang Wu, Jinda Lu +7Reinforcement LearningKL-Regularized RL

  22. Co4ICF: Co-evolving Physics-Informed Surrogate and RL-based Pulse Optimizer for Inertial Confinement Fusion

    Jul 11, 2026Jiatong Zhao, Tengyue Zhang, Yuhan Wang +2Reinforcement LearningSurrogate-Assisted Optimization

  23. Measure the Sim-to-Real Gap: Designing an Affordable Real-World Benchmark Platform for Reinforcement Learning in AIoT Systems

    Jul 11, 2026Rongping Zhou, Omid Tavallaie, Shuaijun Chen +1RL BenchmarksReinforcement Learning

  24. Beyond Euclidean Clipping: Overcoming Exploration Collapse in LLM RL via Riemannian Isometric Policy Optimization

    Jul 11, 2026Zhicheng Cai, Xinyuan Guo, Hanlin Wu +3Reinforcement LearningRL for Language Model Reasoning