Actor-Critic Methods

Momentum

9 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 62

All topics
CardsList
  1. Structure-Conditioned Actor-Critic Branches for Quality-Diversity Reinforcement Learning

    Jun 7, 2026Lianrong Zuo, Peilan Xu, Yong Liu +1Reinforcement LearningPolicy Optimization

  2. Learning to replenish: A hybrid deep reinforcement learning for dynamic inventory management in the pharmaceutical supply chains

    Jun 4, 2026Amandeep Kaur, Gyan PrakashInventory ControlActor-Critic Methods

  3. Retry Policy Gradients in Continuous Action Spaces

    Jun 4, 2026Soichiro Nishimori, Paavo ParmasPolicy OptimizationRL Exploration

  4. From Ticks to Flows: Dynamics of Neural Reinforcement Learning in Continuous Environments

    Jun 2, 2026Saket Tiwari, Tejas Kotwal, George KonidarisRL ControlReinforcement Learning

  5. Refined Analysis of Entropy-Regularized Actor-Critic

    May 23, 2026Safwan Labbi, Paul Mangold, Daniil Tiapkin +1Reinforcement LearningMaximum Entropy RL

  6. Second-Order Actor-Critic Methods for Discounted MDPs via Policy Hessian Decomposition

    May 14, 2026Sanjeev Manivannan, Shuban VReinforcement LearningPolicy Gradient Methods

  7. Collaborative Yet Personalized Policy Training: Single-Timescale Federated Actor-Critic

    May 14, 2026Leo Muxing Wang, Pengkun Yang, Lili SuFederated RLActor-Critic Methods

  8. Achieving ε−2ε^{-2} Sample Complexity for Single-Loop Actor-Critic under Minimal Assumptions

    May 13, 2026Ishaq Hamza, Zaiwei ChenPolicy GradientLast-Iterate Convergence

  9. Debiased Model-based Representations for Sample-efficient Continuous Control

    May 12, 2026Jiafei Lyu, Zichuan Lin, Scott Fujimoto +5Representation LearningContinuous Control

  10. TOPPO: Rethinking PPO for Multi-Task Reinforcement Learning with Critic Balancing

    May 12, 2026Yuanpeng Li, Gefei Lin, Annie Qu +1Multi-Task RLProximal Policy Optimization

  11. XQCfD: Accelerating Fast Actor-Critic Algorithms with Prior Data and Prior Policies

    May 11, 2026Daniel Palenicek, Florian Vogt, Joe Watson +3Robotic RLLearning from Demonstration

  12. DelAC: A Multi-agent Reinforcement Learning of Team-Symmetric Stochastic Games

    May 11, 2026Duan-Shin Lee, Yu-Hsiu HungNash EquilibriumGame Theory

  13. Actor-Critic Algorithm for Dynamic Expectile and CVaR

    May 8, 2026Yudong Luo, Erick DelageReinforcement LearningRisk-Sensitive RL

  14. Your Language Model is Its Own Critic: Reinforcement Learning with Value Estimation from Actor's Internal States

    May 8, 2026Yunho Choi, Jongwon Lim, Woojin Ahn +3Value Function EstimationRL for Language Model Reasoning

  15. Actor-Critic with Active Importance Sampling

    May 8, 2026Majid Molaei, Gabor Paczolay, Matteo Papini +2Reinforcement LearningPolicy Gradient Methods

  16. AdaGamma: State-Dependent Discounting for Temporal Adaptation in Reinforcement Learning

    May 7, 2026Yaomin Wang, Jianting Pan, Ran Tian +4Reinforcement LearningTemporal-Difference Learning

  17. Breaking the Computational Barrier: Provably Efficient Actor-Critic for Low-Rank MDPs

    May 2, 2026Ruiquan Huang, Donghao Li, Yingbin Liang +1Markov Decision ProcessesReinforcement Learning

  18. SAVGO: Learning State-Action Value Geometry with Cosine Similarity for Continuous Control

    May 1, 2026Stavros Orfanoudakis, Pedro P. VergaraRepresentation LearningPolicy Optimization

  19. Bayesian policy gradient and actor-critic algorithms

    Apr 30, 2026Mohammad Ghavamzadeh, Yaakov Engel, Michal ValkoBayesian RLTemporal-Difference Learning

  20. Continuous-time q-learning for mean-field control with common noise, part-II: q-learning algorithms

    Apr 30, 2026Zhenjie Ren, Xiaoli Wei, Xiang Yu +1Reinforcement LearningStochastic Optimal Control

  21. Efficient Reinforcement Learning using Linear Koopman Dynamics for Nonlinear Robotic Systems

    Apr 21, 2026Wenjian Hao, Yuxuan Fang, Zehui Lu +1Robotic ControlReinforcement Learning

  22. Scalable Neighborhood-Based Multi-Agent Actor-Critic

    Apr 20, 2026Tim Goppelsroeder, Rasmus JensenMulti-Agent SystemsActor-Critic Methods

  23. Pretraining in Actor-Critic Reinforcement Learning for Locomotion

    Oct 14, 2025Jiale Fan, Andrei Cramariuc, Tifanny Portela +1RL for RoboticsReinforcement Learning

  24. Efficient Q-Learning and Actor-Critic Methods for Robust Average-Reward Reinforcement Learning

    Jun 8, 2025Yang Xu, Swetha Ganesh, Vaneet AggarwalRobust Markov Decision ProcessesReinforcement Learning

  25. Streaming Deep Reinforcement Learning Finally Works

    Oct 18, 2024Mohamed Elsayed, Elena Sorina Lupu, Gautham Vasan +1Reinforcement LearningActor-Critic Methods

  26. Topology-Guided Modular Actor-Critic Learning for Continuous Systems under Temporal Objectives

    Apr 20, 2023Lening Li, Zhentian Qian, Jianan Xia +7RL ControlReinforcement Learning