Model-Based RL

RL: Reinforcement Learning

Momentum

20 papers in the last four weeks, up 122% on the four weeks before. 0.2% of all new papers.

Jul 6Week of Sep 21

Latest papers 143

All topics
CardsList
  1. Sampling-Based Safe Reinforcement Learning

    May 19, 2026Luca Vignola, Bruce D. Lee, Manish Prajapat +4Robot SafetySafe RL

  2. PH-Dreamer: A Physics-Driven World Model via Port-Hamiltonian Generative Dynamics

    May 18, 2026Xueyu Luan, Chenwei ShiDynamical SystemsReinforcement Learning

  3. Transfer Learning for Customized Car Racing Environments

    May 18, 2026Benedict Florance Arockiaraj, Richard Chang, Wesley YeeAutonomous RacingCross-Domain Transfer Learning

  4. Learning Multi-Timescale Abstractions for Hierarchical Combinatorial Planning

    May 16, 2026Vivienne Huiling Wang, Tinghuai Wang, Joni PajarinenWorld Model-Based PlanningHierarchical RL

  5. EfficientTDMPC: Improved MPC Objectives for Sample-Efficient Continuous Control

    May 15, 2026Thomas Evers, Cristian Meo, Wendelin Bohmer +2Model Predictive ControlContinuous Control

  6. Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making

    May 15, 2026Fan Feng, Selena Ge, Minghao Fu +6Latent Action LearningLatent Dynamics Modeling

  7. Mind Dreamer: Untethering Imagination via Active Causal Intervention on Latent Manifolds

    May 15, 2026Shaojun Xu, Xiaoling Zhou, Yihan Lin +4Reinforcement LearningCredit Assignment in RL

  8. Imperfect World Models are Exploitable

    May 15, 2026Logan Mondal Bhamidipaty, Esmeralda S. Whitammer, David Abel +2Reward HackingWorld Model-Based Planning

  9. Offline Reinforcement Learning with Universal Horizon Models

    May 15, 2026Hojun Chung, Junseo Lee, Songhwai OhOffline RLModel-Based RL

  10. Transferable Delay-Aware Reinforcement Learning via Implicit Causal Graph Modeling

    May 12, 2026Chenran Zhao, Dianxi Shi, Yaowen Zhang +2Causal Representation LearningReinforcement Learning

  11. PriorZero: Bridging Language Priors and World Models for Decision Making

    May 12, 2026Junyu Xiong, Yuan Pu, Jia Tang +1LLM-Guided RLLatent World Models

  12. OrbiSim: World Models as Differentiable Physics Engines for Embodied Intelligence

    May 12, 2026Jiajian Li, Jingyuan Huang, Junru Gong +3Robotic ControlRobotics Simulation

  13. Debiased Model-based Representations for Sample-efficient Continuous Control

    May 12, 2026Jiafei Lyu, Zichuan Lin, Scott Fujimoto +5Representation LearningContinuous Control

  14. Offline Policy Optimization with Posterior Sampling

    May 8, 2026Hongqiang Lin, Dongxu Zhang, Yiding Sun +3OOD GeneralizationPosterior Sampling

  15. Improved Model-based Reinforcement Learning with Smooth Kernels

    May 8, 2026Kun Long, Yuqiang Li, Xianyi WuReinforcement LearningContinuous-Time RL

  16. Sequential Design of Genetic Circuits Under Uncertainty With Reinforcement Learning

    May 7, 2026Michal Kobiela, Diego A. Oyarzún, Michael U. GutmannReinforcement LearningModel-Based RL

  17. On Training in Imagination

    May 7, 2026Nadav Timor, Ravid Shwartz-Ziv, Micah Goldblum +2Reward ModelingReinforcement Learning

  18. Offline Reinforcement Learning for Rotation Profile Control in Tokamaks

    May 7, 2026Rohit Sonker, Hiro Josep Farre Kaga, Jiayu Chen +5RL ControlOffline RL

  19. ELVIS: Ensemble-Calibrated Latent Imagination for Long-Horizon Visual MPC

    May 6, 2026Yurui Du, Pinhao Song, Yutong Hu +1Visual SSMsModel Predictive Control

  20. Dream-MPC: Gradient-Based Model Predictive Control with Latent Imagination

    May 6, 2026Jonathan Spieler, Sven BehnkeModel Predictive ControlOptimal Control

  21. Counter-Dyna: Data-Efficient RL-Based HVAC Control using Counterfactual Building Models

    May 6, 2026Jan Marco Ruiz de Vargas, Fabian Raisch, Zoltan Nagy +2Neural Surrogate ModelingBuilding Energy Management

  22. Adaptive Estimation and Optimal Control in Offline Contextual MDPs without Stationarity

    May 5, 2026Riddhiman Bhattacharyya, Sayak Chakrabarty, Imon BanerjeeNon-Stationary RLMarkov Decision Processes

  23. Closed-Loop CO2 Storage Control With History-Based Reinforcement Learning and Latent Model-Based Adaptation

    May 4, 2026Sofianos Panagiotis Fotias, Vassilis GaganisRL ControlLatent Dynamics Modeling

  24. TRAP: Tail-aware Ranking Attack for World-Model Planning

    May 3, 2026Siyuan Duan, Ke Zhang, Xizhao LuoBackdoor AttacksWorld Model-Based Planning

  25. Model-Based Proactive Cost Generation for Learning Safe Policies Offline with Limited Violation Data

    May 2, 2026Ruiqi Xue, Lei Yuan, Kainuo Cheng +2LLM-Guided RLOffline RL

  26. Learning to Race in Minutes: Infoprop Dyna on the Mini Wheelbot

    May 1, 2026Devdutt Subhasish, Henrik Hose, Sebastian TrimpeRobot Skill LearningAutonomous Racing

  27. Model-Based Reinforcement Learning with Double Oracle Efficiency in Policy Optimization and Offline Estimation

    May 1, 2026Haichen Hu, Jian Qian, David Simchi-LeviRegret Minimization in RLMarkov Decision Processes

  28. Interpretable experiential learning based on state history and global feedback

    May 1, 2026Anton KoloninReinforcement LearningGame-Playing Agents