Model-Free RL

RL: Reinforcement Learning

Momentum

5 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 45

All topics
CardsList
  1. RLDISCOVER: LLM-driven co-evolution of reinforcement learning algorithms

    Oct 6, 2026Haoran Li, Zengle Ge, Xiaomin Yuan +14Automated Algorithm DiscoveryModel-Free RL

  2. Reachability-Aware Diffusion Policy Optimization

    Oct 5, 2026Hikmet Simsir, Kutay Demiray, Ozgur S. OguzConstrained RLDiffusion Policy

  3. Taylor Representations for Model-Free RL in Networked MDPs

    Oct 4, 2026Salah Chikhi, Abdelhaq Chaoui, Asuman Ozdaglar +1Markov Decision ProcessesRepresentation Learning for RL

  4. Q-Learning for Reachability in MEC-Free MDPs

    Oct 1, 2026Lu-Chin Chang, Suguman BansalMarkov Decision ProcessesReinforcement Learning

  5. Deep Epistemic Value Functions for Optimistic Exploration

    Sep 28, 2026Leander Diaz-Bone, Marco Bagatella, Jonas Hübotter +1Value Function EstimationRL Exploration

  6. GraphHCA: Closed-Form Hindsight Credit Assignment for Long-Horizon LLM Agents

    Sep 28, 2026Haodong Zhu, Yangyang Ren, Changbai Li +4Credit Assignment in RLStep-Level Credit Assignment in RL

  7. Lifted Bellman Linear Programming for Offline Reinforcement Learning

    Sep 21, 2026Hyukjun Yang, Jongchan Park, Narim Jeong +1Reinforcement LearningOffline RL

  8. ProDVI: Programmatic Dynamics Priors for Value Network Initialization

    Aug 6, 2026Xinwei Liu, Junyuan Liang, Jianting Zhang +1Reinforcement LearningLLM-Guided RL

  9. Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control

    Aug 6, 2026Xinwei Liu, Junyuan Liang, Jianting Zhang +1Predictive Representation LearningContinuous Control

  10. Exact Model-Free Policy Iteration for Co-safe LTL Planning

    Aug 5, 2026Zetong Xuan, Yu WangReinforcement LearningPolicy Iteration

  11. Finite-Time Analysis of Discounted Exponential-Utility Reinforcement Learning

    Aug 3, 2026Ankur Naskar, Vivek T A, Aditya Kumar +2Reinforcement LearningRisk-Sensitive RL

  12. Exact Action Values Are Not Enough: Rollout-Verified Reinforcement Fine-Tuning of a Reasoning Model for Multi-Zone VAV Control

    Jul 30, 2026Takumi Shioda, Kohei Terashima, Tatsuo NagaiLanguage Model-Based ControlModel-Free RL

  13. Physics-Aware End-to-End Deep Reinforcement Learning for Quadcopter Control with Actuator Dynamics

    Jul 28, 2026Ya-Chia Shen, Woei-Leong ChanRL ControlQuadrotor Control

  14. Principled Direction-Free Intrinsic Motivation through Model-Free Epistemic Free-Energy Estimators

    Jul 18, 2026Alireza Furutanpey, Schahram DustdarFree Energy CalculationIntrinsic Reward Methods

  15. Actor-Critic Learning for Extended Mean Field Control with Deterministic Policies

    Jul 13, 2026Ziheng Cheng, Xin Guo, Huyên Pham +1Policy GradientContinuous-Time RL

  16. Can Reinforcement Learning Efficiently Discover Price Manipulation?

    Jul 7, 2026Ioanna-Yvonni Tsaknaki, Andrea Macrì, Fabrizio LilloModel-Free RLAlgorithmic Trading

  17. Mean-Field PhiBE: Continuous-Time Mean-Field Reinforcement Learning from Discrete-Time Data

    Jun 25, 2026Erhan Bayraktar, Martin Hernandez, Qinxin Yan +1Reinforcement LearningStochastic Optimal Control

  18. Managing Task Execution for Unknown Workloads in Batteryless IoT: A Hardware-Agnostic Evaluation

    Jun 23, 2026Samer Nasser, Henrique Duarte Moura, Ritesh Kumar Singh +2Internet of ThingsModel-Free RL

  19. NASDAQ: Normalized Observation Space Dynamics-Augmented Q-Learning

    Jun 19, 2026Xinwei Liu, Junyuan Liang, Zicong Hong +2Reinforcement LearningQ-Learning

  20. Inverting the Bellman Equation: From QQ-Values to World Models

    Jun 19, 2026Alistair Letcher, Mattie Fellows, Alexander D. Goldie +3Reinforcement LearningModel-Free RL

  21. Model-Free Reinforcement Learning Control for Resilient Cyber-Physical Systems

    Jun 17, 2026Hugo O. Garcés, Alejandro J. Rojas, Bernardo A. Hernández +5RL ControlCyber-Physical Systems

  22. Learning Policy from a Single Trajectory in Average-Reward Markov Decision Process

    Jun 15, 2026Jongmin Lee, Ernest K. Ryu, Vaneet AggarwalMarkov Decision ProcessesReinforcement Learning

  23. Deterministic Policy Gradient for Learning Equilibrium in Time-Inconsistent Control Problems

    Jun 10, 2026Xin Guo, Yijie Huang, Xiang YuPolicy GradientStochastic Optimal Control

  24. Event-Driven Reinforcement Learning Enables Long-Horizon Control in Semiconductor Fabrication

    Jun 9, 2026Yavar Yeganeh, Mahsa Shekari, Nicla Frigerio +2RL ControlMulti-Objective Reinforcement Learning

  25. An Agency-Transferring Model-Free Policy Enhancement Technique

    Jun 8, 2026Anton Bolychev, Georgiy Malaniya, Sinan Ibrahim +1RL ControlTransfer Learning

  26. Representation Learning Enables Scalable Multitask Deep Reinforcement Learning

    Jun 4, 2026Johan Obando-Ceron, Lu Li, Scott Fujimoto +3Reinforcement LearningRepresentation Learning for RL

  27. Cortex and subcortex play distinct roles over learning when cortical memory is limited

    May 30, 2026Matthew Farrell, Taro ToyoizumiComputational Cognitive ModelingReinforcement Learning

  28. ReversedQ: Opportunities for Faster Q-Learning in Episodic Online Reinforcement Learning

    May 20, 2026Sofia R. Miskala-Dinc, Aviva PrinsReinforcement LearningQ-Learning