Reinforcement Learning

Also known as RL

Momentum

144 papers in the last four weeks, up 243% on the four weeks before. 1.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 1,138

All topics
CardsList
  1. ELEMENT: Episodic and Lifelong Exploration via Maximum Entropy

    Dec 5, 2024Hongming Li, Zhao Yang, Xiaoxuan Liang +2Intrinsic Reward MethodsReinforcement Learning

  2. Reinforcement learning for Quantum Tiq-Taq-Toe

    Nov 10, 2024Catalin-Viorel Dinu, Thomas MoerlandReinforcement LearningGame-Playing Agents

  3. RL-STaR: Theoretical Analysis of Reinforcement Learning Frameworks for Self-Taught Reasoner

    Oct 31, 2024Fu-Chieh Chang, Yu-Ting Lee, Hui-Ying Shih +2Reinforcement LearningRL for Language Model Reasoning

  4. Streaming Deep Reinforcement Learning Finally Works

    Oct 18, 2024Mohamed Elsayed, Elena Sorina Lupu, Gautham Vasan +1Reinforcement LearningActor-Critic Methods

  5. Training on Irrelevant States Implies Data Augmentation: Generalization in Contextual MDPs

    Oct 4, 2024Max Weltevrede, Caroline Horsch, Matthijs T. J. Spaan +1Reinforcement LearningRL Exploration

  6. Deep Reinforcement Learning for Reach-Avoid-Stay Problems

    Oct 3, 2024Gabriel Chenevert, Jingqi Li, Achyuta kannan +2Robust ControlReinforcement Learning

  7. Exploiting Exogenous Structure for Sample-Efficient Reinforcement Learning

    Sep 22, 2024Jia Wan, Sean R. Sinclair, Devavrat Shah +1Regret Minimization in RLMarkov Decision Processes

  8. Mitigating the Stability-Plasticity Dilemma in Adaptive Train Scheduling with Curriculum-Driven Continual DQN Expansion

    Aug 19, 2024Achref Jaziri, Etienne Künzel, Visvanathan RameshStability-Plasticity DilemmaNon-Stationary RL

  9. Training Verifiably Robust Agents Using Set-Based Reinforcement Learning

    Aug 17, 2024Manuel Wendl, Lukas Koller, Tobias Ladner +1RL ControlReinforcement Learning

  10. ProSpec RL: Plan Ahead, then Execute

    Jul 31, 2024Liangliang Liu, Yi Guan, BoRan Wang +5Reinforcement LearningRisk-Sensitive RL

  11. Enhancing Hardware Fault Tolerance in Machines with Reinforcement Learning Policy Gradient Algorithms

    Jul 21, 2024Sheila Schoepp, Mehran Taghian, Shotaro Miwa +3RL ControlReinforcement Learning

  12. Thompson Sampling for Infinite-Horizon Discounted Decision Processes

    May 14, 2024Daniel Adelman, Cagla Keceli, Alba V. Olivares-NadalThompson SamplingRegret Minimization in RL

  13. TERC: A Transfer Entropy Redundancy Criterion for State Variable Selection in Reinforcement Learning

    Jan 21, 2024Charles Westphal, Stephen Hailes, Mirco MusolesiReinforcement LearningState Representation Learning

  14. JaxMARL: Multi-Agent RL Environments and Algorithms in JAX

    Nov 16, 2023Alexander Rutherford, Benjamin Ellis, Matteo Gallici +18RL BenchmarksReinforcement Learning

  15. Bridging the Gap between Newton-Raphson Method and Regularized Policy Iteration

    Oct 11, 2023Zeyang Li, Chuxiong Hu, Yunan Wang +4Markov Decision ProcessesReinforcement Learning

  16. Robust Recurrent Reinforcement Learning under Evolving Hidden Disturbances with Application to Rover Wheel Slip

    Jul 29, 2023Saki Omi, Hyo-Sang Shin, Namhoon Cho +2RL for RoboticsReinforcement Learning

  17. ETHER: Aligning Emergent Communication for Hindsight Experience Replay

    Jul 28, 2023Kevin Yandoka Denamganaï, Daniel Hernandez, Ozan Vardal +2Reinforcement LearningExperience Replay

  18. Reinforcement Learning with Temporal-Logic-Based Causal Diagrams

    Jun 23, 2023Yash Paliwal, Rajarshi Roy, Jean-Raphaël Gaglione +5Reinforcement LearningCausal RL

  19. Topology-Guided Modular Actor-Critic Learning for Continuous Systems under Temporal Objectives

    Apr 20, 2023Lening Li, Zhentian Qian, Jianan Xia +7RL ControlReinforcement Learning

  20. Playing 20 Question Game with Policy-Based Reinforcement Learning

    Aug 23, 2018Huang Hu, Xianchao Wu, Bingfeng Luo +4Reinforcement LearningGame-Playing Agents

  21. Safe Learning Under Irreversible Dynamics via Asking for Help

    Date pendingBenjamin Plaut, Juan Liévano-Karim, Hanlin Zhu +1Regret Minimization in RLReinforcement Learning

  22. AsyncFlow: An Asynchronous Streaming RL Framework for Efficient LLM Post-Training

    Date pendingZhenyu Han, Ansheng You, Haibo Wang +16RL for Language ModelsAsynchronous RL

  23. UBCL: A Reinforcement Learning Framework for Controllable and Diverse Player Behaviors

    Date pendingAtahan Cilan, Atay ÖzgövdeReinforcement LearningHuman Behavior Simulation

  24. Partial GFlowNet: Accelerating Convergence in Large State Spaces via Strategic Partitioning

    Date pendingXuan Yu, Xu Wang, Rui Zhu +2Reinforcement LearningGenerative Flow Networks

  25. Bringing Value Models Back: Generative Critics for Value Modeling in LLM Reinforcement Learning

    Date pendingZikang Shan, Han Zhong, Liwei Wang +1RL for Language ModelsReinforcement Learning

  26. Using Reward Uncertainty to Induce Diverse Behaviour in Reinforcement Learning

    Date pendingAnthony GX-Chen, Ankit Anand, Gheorghe Comanici +7Reinforcement LearningRL for Language Model Reasoning