Model-Based RL

RL: Reinforcement Learning

Momentum

24 papers in the last four weeks, up 243% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 142

All topics
CardsList
  1. Scaling Automatic Research Agents via World Models

    Aug 12, 2026Xiyuan Yang, Sheikh Sarwar, Jingru Cheng +8World Model LearningRL Post-Training

  2. Dynamics Models for Offline Hyperparameter Selection in Real-World RL

    Aug 11, 2026Jordan Coblin, Han Wang, Martha White +1RL ControlOffline RL

  3. IADD-TR: Intervention-Aware Dynamics Decoupling with Targeted Regularization for Model-Based Reinforcement Learning

    Aug 11, 2026Zefeng Liang, Jie Qiao, Ruichu Cai +2Reinforcement LearningRobust RL

  4. LUCID: Latent-Skill Unified Control via Imagined Dynamics for Long-Horizon Humanoid Loco-Manipulation

    Aug 7, 2026Cheng Guo, Mingzhe Ni, Angelo Cangelosi +1Humanoid Loco-ManipulationLatent Action Learning

  5. Dueling World Models: Advantage-Style Action Channels for Common-Mode Distractor Rejection

    Aug 7, 2026Jiazhuo Li, Yiming Fei, Zhiruo Zhou +1Action-Conditioned World ModelsLatent World Models

  6. Analytic Planning under Uncertainty with Moment Closure

    Aug 3, 2026Shishir Sharma, Doina PrecupDecision-Making under UncertaintyModel-Based RL

  7. Climate-Dyna Deep Hedging for XVAs: Model-Based Reinforcement Learning, Residual Climate HVA, and Hedge-Instrument Discovery

    Aug 2, 2026Xiaozhen Wang, Francois Buet-GolfouseQuantitative FinanceResidual Policy Learning

  8. DreamQAS: Learning a Decision-Useful World Model for VQE-Efficient Quantum Architecture Search

    Jul 31, 2026Jiayang Niu, Yan Wang, Jie Li +4World ModelsQuantum RL

  9. Sample Efficient Hierarchical Reinforcement Learning via Best Policy Identification

    Jul 31, 2026Anders Jonsson, Emilie Kaufmann, Gianmarco Tedeschi +1Hierarchical RLPolicy Learning

  10. QQWorld: Quantile-Quantile Matching for World Model Regularization

    Jul 30, 2026Zhoushun Yu, Xiaoyu Hu, Xiangyu XuWorld Model LearningWorld Model-Based Planning

  11. Learning Implicit Causal World Models from Multi-Agent Demonstrations

    Jul 28, 2026Jasorsi GhoshCausal Representation LearningCausal World Models

  12. Reinformed Dreamer: An Asymmetric World Model Efficiently Trained through Latent Guidance

    Jul 28, 2026Gaspard Lambrechts, Adrien Bolland, Daniel Ebi +1Reinforcement LearningWorld Models

  13. Dreamer-CPC: Message Learning with World Models for Decentralized Multi-agent Reinforcement Learning

    Jul 22, 2026Taisuke Takayama, Naoto Yoshida, Tadahiro TaniguchiPredictive CodingPartially Observable RL

  14. Koopman Dreamer: Spectrally Constrained Latent Dynamics for Stable World-Model Imagination

    Jul 22, 2026Jiaqi Li, Xinglong Zhang, Haibin Xie +3Koopman Operator LearningLatent Dynamics Modeling

  15. Reinforcement Learning: From Algorithms To Foundation Models

    Jul 20, 2026Zihan DingReinforcement LearningRL for Video Generation

  16. Enhancing Personalized Bladder Cancer Treatment Through Reinforcement Learning: A Recurrent Patient State Transition Decision Support Framework

    Jul 18, 2026Divyansh Chawla, Anshu Garg, Isshaan SinghReinforcement LearningHealthcare

  17. Learning from World Feedback: Why Model Uncertainty Fails as a Risk Signal in Model-Based RL

    Jul 18, 2026Zhaohui WangRisk-Sensitive RLModel Predictive Control

  18. Certifiable Safe Model-Based Reinforcement Learning with Control-Affine Dynamics Approximation

    Jul 17, 2026Hao Zhou, Yanze Zhang, Cameron Reid +1Safe RLModel-Based RL

  19. RENEW: Towards Learning World Models and Repairing Model Exploitation from Preferences

    Jul 15, 2026Logan Mondal Bhamidipaty, Mykel Kochenderfer, Subramanian RamamoorthyWorld Model LearningOffline RL

  20. Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models

    Jul 14, 2026Ilias Kazantzidis, Timothy J. Norman, Yali Du +1Safe RLReward Design for RL

  21. Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning

    Jul 10, 2026Guanquan Wang, Yoshimasa TsuruokaTrajectory GenerationOffline RL

  22. Solving Markov Decision Processes with Future Information via MPC

    Jun 23, 2026Shambhuraj Sawant, Akhil S Anand, Dirk Reinhardt +1RL ControlMarkov Decision Processes

  23. Inverting the Bellman Equation: From QQ-Values to World Models

    Jun 19, 2026Alistair Letcher, Mattie Fellows, Alexander D. Goldie +3Reinforcement LearningModel-Free RL