Model-Based RL

RL: Reinforcement Learning

Momentum

24 papers in the last four weeks, up 243% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 142

All topics
CardsList
  1. Learning Multi-Timescale Abstractions for Hierarchical Combinatorial Planning

    May 16, 2026Vivienne Huiling Wang, Tinghuai Wang, Joni PajarinenWorld Model-Based PlanningHierarchical RL

  2. EfficientTDMPC: Improved MPC Objectives for Sample-Efficient Continuous Control

    May 15, 2026Thomas Evers, Cristian Meo, Wendelin Bohmer +2Model Predictive ControlContinuous Control

  3. Ada-Diffuser: Latent-Aware Adaptive Diffusion for Decision-Making

    May 15, 2026Fan Feng, Selena Ge, Minghao Fu +6Latent Action LearningLatent Dynamics Modeling

  4. Mind Dreamer: Untethering Imagination via Active Causal Intervention on Latent Manifolds

    May 15, 2026Shaojun Xu, Xiaoling Zhou, Yihan Lin +4Reinforcement LearningCredit Assignment in RL

  5. Imperfect World Models are Exploitable

    May 15, 2026Logan Mondal Bhamidipaty, Esmeralda S. Whitammer, David Abel +2Reward HackingWorld Model-Based Planning

  6. Offline Reinforcement Learning with Universal Horizon Models

    May 15, 2026Hojun Chung, Junseo Lee, Songhwai OhOffline RLModel-Based RL

  7. Transferable Delay-Aware Reinforcement Learning via Implicit Causal Graph Modeling

    May 12, 2026Chenran Zhao, Dianxi Shi, Yaowen Zhang +2Causal Representation LearningReinforcement Learning

  8. PriorZero: Bridging Language Priors and World Models for Decision Making

    May 12, 2026Junyu Xiong, Yuan Pu, Jia Tang +1LLM-Guided RLLatent World Models

  9. OrbiSim: World Models as Differentiable Physics Engines for Embodied Intelligence

    May 12, 2026Jiajian Li, Jingyuan Huang, Junru Gong +3Robotic ControlRobotics Simulation

  10. Debiased Model-based Representations for Sample-efficient Continuous Control

    May 12, 2026Jiafei Lyu, Zichuan Lin, Scott Fujimoto +5Representation LearningContinuous Control

  11. Offline Policy Optimization with Posterior Sampling

    May 8, 2026Hongqiang Lin, Dongxu Zhang, Yiding Sun +3OOD GeneralizationPosterior Sampling

  12. Improved Model-based Reinforcement Learning with Smooth Kernels

    May 8, 2026Kun Long, Yuqiang Li, Xianyi WuReinforcement LearningContinuous-Time RL

  13. Sequential Design of Genetic Circuits Under Uncertainty With Reinforcement Learning

    May 7, 2026Michal Kobiela, Diego A. Oyarzún, Michael U. GutmannReinforcement LearningModel-Based RL

  14. On Training in Imagination

    May 7, 2026Nadav Timor, Ravid Shwartz-Ziv, Micah Goldblum +2Reward ModelingReinforcement Learning

  15. Offline Reinforcement Learning for Rotation Profile Control in Tokamaks

    May 7, 2026Rohit Sonker, Hiro Josep Farre Kaga, Jiayu Chen +5RL ControlOffline RL

  16. ELVIS: Ensemble-Calibrated Latent Imagination for Long-Horizon Visual MPC

    May 6, 2026Yurui Du, Pinhao Song, Yutong Hu +1Visual SSMsModel Predictive Control

  17. Dream-MPC: Gradient-Based Model Predictive Control with Latent Imagination

    May 6, 2026Jonathan Spieler, Sven BehnkeModel Predictive ControlOptimal Control

  18. Counter-Dyna: Data-Efficient RL-Based HVAC Control using Counterfactual Building Models

    May 6, 2026Jan Marco Ruiz de Vargas, Fabian Raisch, Zoltan Nagy +2Neural Surrogate ModelingBuilding Energy Management

  19. Adaptive Estimation and Optimal Control in Offline Contextual MDPs without Stationarity

    May 5, 2026Riddhiman Bhattacharyya, Sayak Chakrabarty, Imon BanerjeeNon-Stationary RLMarkov Decision Processes

  20. Closed-Loop CO2 Storage Control With History-Based Reinforcement Learning and Latent Model-Based Adaptation

    May 4, 2026Sofianos Panagiotis Fotias, Vassilis GaganisRL ControlLatent Dynamics Modeling

  21. TRAP: Tail-aware Ranking Attack for World-Model Planning

    May 3, 2026Siyuan Duan, Ke Zhang, Xizhao LuoBackdoor AttacksWorld Model-Based Planning

  22. Model-Based Proactive Cost Generation for Learning Safe Policies Offline with Limited Violation Data

    May 2, 2026Ruiqi Xue, Lei Yuan, Kainuo Cheng +2LLM-Guided RLOffline RL

  23. Learning to Race in Minutes: Infoprop Dyna on the Mini Wheelbot

    May 1, 2026Devdutt Subhasish, Henrik Hose, Sebastian TrimpeRobot Skill LearningAutonomous Racing

  24. Model-Based Reinforcement Learning with Double Oracle Efficiency in Policy Optimization and Offline Estimation

    May 1, 2026Haichen Hu, Jian Qian, David Simchi-LeviRegret Minimization in RLMarkov Decision Processes

  25. Interpretable experiential learning based on state history and global feedback

    May 1, 2026Anton KoloninReinforcement LearningGame-Playing Agents

  26. RAY-TOLD: Ray-Based Latent Dynamics for Dense Dynamic Obstacle Avoidance with TDMPC

    Apr 30, 2026Seungho Han, Seokju Lee, Jeonguk KangRobot NavigationMPPI Control

  27. Uncertainty-Aware Predictive Safety Filters for Probabilistic Neural Network Dynamics

    Apr 29, 2026Bernd Frauenknecht, Lukas Kesper, Daniel Mayfrank +2Uncertainty QuantificationModel Predictive Control