Reinforcement Learning

Also known as RL

Momentum

144 papers in the last four weeks, up 243% on the four weeks before. 1.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 1,138

All topics
CardsList
  1. Nonparametric Bayesian Inverse Reinforcement Learning with Data-Parallel Gibbs Sampling

    Jul 10, 2026Sai Anirudh Katupilla, Shreeya Dasa LakshminathReinforcement LearningBayesian Inference

  2. PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers

    Jul 10, 2026Yujie Pang, Zudong LiReinforcement LearningContact-Rich Robotic Manipulation

  3. Vascular Geometry Characterization for AI-Based Endovascular Navigation

    Jul 10, 2026Han-Ru Wu, Harry Robertshaw, Lisa Dwyer-Joyce +2Reinforcement LearningMedical Image Analysis

  4. Toward Active Object Detection for UAVs in the Wild: A Large-Scale Dataset, Benchmark and Method

    Jul 10, 2026Tianpeng Liu, Xinhua Jiang, Li Liu +4Reinforcement LearningObject Detection

  5. Multi-Modal, Multi-Environment Machine Teaching for Robust Reward Learning

    Jul 9, 2026Ali Larian, Qian Lin, Chang Zong Wu +1Reinforcement LearningHuman-in-the-Loop AI

  6. Statistical Efficiency and Inference of Quantile Distributional Reinforcement Learning

    Jul 9, 2026Zijie Cheng, Yang Peng, Zhihua ZhangDistributional RLReinforcement Learning

  7. Single-Rollout Asynchronous Optimization for Agentic Reinforcement Learning

    Jul 8, 2026Zhenyu Hou, Yujiang Li, Jie Tang +1Agentic RLAsynchronous RL

  8. ORCAID: Oblique Rule-Based Continuous-Action Interpretation for Deep RL Policies

    Jul 8, 2026Ignacio D. Lopez-Miguel, Ezio Bartocci, Thomas Eiter +1Reinforcement LearningInterpretable ML

  9. Mathematical methods of reinforcement learning

    Jul 8, 2026Denis Belomestny, Alexander Gasnikov, Egor Gladin +5Markov Decision ProcessesReinforcement Learning

  10. A Gold-Standard Study of What Makes a Lightweight Game-Playing Agent Strong

    Jul 7, 2026Nima Kelidari, Mohammadsaeed Haghi, Mahdi SalmaniReinforcement LearningGame-Playing Agents

  11. Federated Physics-Grounded Reinforcement Learning for Distributed Stability Control in Smart Grids

    Jul 6, 2026Omar Al-Refai, Ibrahim Shahbaz, Adam Ali Husseinat +1Reinforcement LearningFederated RL

  12. Self-Review Reinforcement Learning (SRRL) with Cross-Episode Memory and Policy Distillation

    Jul 6, 2026Muhammad Zain Amin, Kibele Sebnem YildirimReinforcement LearningRL for Language Model Reasoning

  13. Diffusion-Guided Uncertainty-Aware Delayed Policy Optimization

    Jul 6, 2026Junqi Tu, Zejiao Liu, Fangfei Li +1Reinforcement LearningRobotic RL

  14. RL-Ballast: Ship Ballast Water Path Planning and Clog Prediction via Reinforcement Learning

    Jul 6, 2026Ming-Kuan Lin, Yi-Chung Lai, Ming-Hsin Chiang +2RL ControlReinforcement Learning

  15. LLM-as-a-Tutor: Policy-Aware Prompt Adaptation for Non-Verifiable RL

    Jul 5, 2026Yujin Kim, Namgyu Ho, Sangmin Hwang +7RL for Language ModelsReinforcement Learning

  16. Target-Aware Interaction-Guided Reinforcement Learning for Black-Box Node Injection Attacks on Graph Neural Networks

    Jul 5, 2026Yi Lan, Ye YuanGraph Neural NetworksReinforcement Learning

  17. CDCP: Conditional Diffusion Model with Contextual Prompts for Multi-task Offline Safe Reinforcement Learning

    Jul 4, 2026Jiayi Guan, Tianle Zhang, Li Shen +8Reinforcement LearningConstrained RL

  18. Explainable Reinforcement Learning for Adaptive Traffic Signal Control

    Jul 4, 2026Dickens Kwesiga, Nishu Choudhary, Angshuman Guin +1Reinforcement LearningTraffic Signal Control

  19. Agent Reinforcement Learning via Pivotal-Aware Self-Feedback Retry

    Jul 4, 2026Weiyang Guo, Zesheng Shi, Longhui Zhang +3Reinforcement LearningCredit Assignment in RL

  20. High-Precision Formation Control for Heterogeneous Multi-Robot Systems via Hierarchical Hybrid Physics-Informed Deep Reinforcement Learning

    Jul 3, 2026Yanzhou Li, Guangli Chen, Xiao-Meng Li +3Multi-Robot Formation ControlMulti-Robot Systems

  21. Reinforcement Learning for Heterogeneous Sensor Selection in Maritime Surveillance

    Jul 3, 2026Andrei Starodubov, Yaqub Aris Prabowo, Andreas Hadjipieris +2Reinforcement Learning

  22. CRRL: A Causality-Based Reinforcement Learning Framework for Autonomous System Recovery

    Jul 3, 2026Safia Fatima, Kai Olav Ellefsen, Leon MoonenReinforcement LearningRobot Failure Recovery

  23. Anticipatory Reinforcement Learning for Trajectory Tracking

    Jul 3, 2026Georg Schäfer, Jakob Rehrl, Stefan Huber +1RL ControlRobot Trajectory Tracking

  24. Integrating Physics-Informed Neural Networks for Safe Reinforcement Learning in a 1-DoF Helicopter System

    Jul 3, 2026Georg Schäfer, Jakob Rehrl, Stefan HuberRL ControlReinforcement Learning