Maximum Entropy RL

RL: Reinforcement Learning

Momentum

6 papers in the last four weeks, with none the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 45

All topics
CardsList
  1. Revisiting Mixture Policies in Entropy-Regularized Actor-Critic

    May 9, 2026Jiamin He, Samuel Neumann, Jincheng Mei +2RL ControlPolicy Optimization

  2. Generative Actor-Critic with Soft Bridge Policies

    May 9, 2026Ke He, Le He, Shunpu Tang +2Policy OptimizationMaximum Entropy RL

  3. Entropy-Regularized Adjoint Matching for Offline Reinforcement Learning

    May 7, 2026Abdelghani Ghanem, Mounir GhoghoFlow MatchingOffline RL

  4. Global Optimality for Constrained Exploration via Penalty Regularization

    Apr 30, 2026Florian Wolf, Ilyas Fatkhullin, Niao HeConstrained RLMaximum Entropy RL

  5. Continuous-time q-learning for mean-field control with common noise, part-I: Theoretical foundations

    Apr 30, 2026Zhenjie Ren, Xiaoli Wei, Xiang Yu +1Stochastic Optimal ControlQ-Learning

  6. Addressing Performance Saturation for LLM RL via Precise Entropy Curve Control

    Apr 29, 2026Bolian Li, Yifan Wang, Yi Ding +3RL for Language ModelsReinforcement Learning

  7. Maximum Entropy Semi-Supervised Inverse Reinforcement Learning

    Apr 22, 2026Julien Audiffren, Michal Valko, Alessandro Lazaric +1Reinforcement LearningMaximum Entropy RL

  8. Planning in entropy-regularized Markov decision processes and games

    Apr 21, 2026Jean-Bastien Grill, Omar Darwiche Domingues, Pierre Ménard +2Value Function EstimationMarkov Models

  9. Targeted Exploration via Unified Entropy Control for Reinforcement Learning

    Apr 16, 2026Chen Wang, Lai Wei, Yanzhi Zhang +5Reinforcement LearningRL for Language Model Reasoning

  10. Tracking Drift: Variation-Aware Entropy Scheduling for Non-Stationary Reinforcement Learning

    Jan 27, 2026Tongxi Wang, Zhuoyang Xia, Xinran Chen +1Non-Stationary RLSequential Decision Making

  11. Soft Fitted Q-Iteration without Bellman Completeness: Occupancy Reweighting and Temperature Annealing

    Dec 30, 2025Lars van der Laan, Nathan KallusReinforcement LearningKL-Regularized RL

  12. Diffusion-Augmented Markov Decision Processes for Maximum Entropy Reinforcement Learning

    Dec 1, 2025Sebastian Sanokowski, Kaustubh Patil, Majid KhadivRL ControlDiffusion Policy

  13. Action-Driven Processes for Continuous-Time Control

    Oct 30, 2025Ruimin He, Shaowei LinMaximum Entropy RLContinuous Control

  14. Discrete Compositional Generation via General Soft Operators and Robust Reinforcement Learning

    Jun 20, 2025Marco Jiralerspong, Esther Derman, Danilo Vucetic +5Scientific DiscoveryGenerative Modeling

  15. ELEMENT: Episodic and Lifelong Exploration via Maximum Entropy

    Dec 5, 2024Hongming Li, Zhao Yang, Xiaoxuan Liang +2Intrinsic Reward MethodsReinforcement Learning