Model-Based Reinforcement Learning

Latest papers 110

All topics
CardsList
  1. Completion-Aware Cross-Fidelity Offline-to-Online Reinforcement Learning for Multi-Line Bus Holding

    Sep 30, 2026Yifan Zhang, Qifan Zhang, Liang ZhengModel-Based Reinforcement Learning

  2. Q-learning Penalized Transformer for Safe Offline Reinforcement Learning

    Sep 28, 2026Shengchao Hu, Peng Wang, Jifeng Hu +5Model-Based Reinforcement LearningQ-Learning

  3. Lifted Bellman Linear Programming for Offline Reinforcement Learning

    Sep 21, 2026Hyukjun Yang, Jongchan Park, Narim Jeong +1Model-Based Reinforcement LearningOffline Reinforcement Learning

  4. Efficient Bayes-Adaptive Reinforcement Learning with Temporal Logic Specifications

    Sep 17, 2026Jonathan Hau, Alessandro AbateLinear Temporal LogicsModel-Based Reinforcement Learning

  5. Model-based Bootstrap for Offline Policy Evaluation in Tabular Reinforcement Learning

    Sep 17, 2026Weiwei Wang, Yuqiang Li, Xianyi Wu +1Model-Based Reinforcement LearningModel-Based Bootstrap

  6. Autonomous Droplet Navigation via Model-Based Reinforcement Learning

    Sep 14, 2026Rajneesh Anand, Mayuresh V. KothareFluid ControlsModel-Based Reinforcement Learning

  7. Distributed Optimization of Modular Production Systems using Model-based Reinforcement Learning with Inverse Models

    Sep 12, 2026Andreas Schwung, Steve Yuwono, Sofiene Lassoued +1Model-Based Reinforcement LearningManufacturing

  8. Amortized Low-Rank Adaptation for Model-Based Reinforcement Learning

    Sep 10, 2026Fernando Palafox, David Fridovich-KeilModel-Based Reinforcement LearningIn-Context Learning

  9. CAST: Alternating State-Value Targets and Expanded Policy Gradients for Model-Based Reinforcement Learning

    Sep 8, 2026Pietro Noah Crestaz, Mohamed Yassine Kabouri, Nicolas Mansard +1Model-Based Reinforcement LearningPolicy Gradient

  10. Routing Dense Layouts with History-Aware Offline Reinforcement Learning using LSTM

    Sep 8, 2026Afsara Khan, Austin RovinskiModel-Based Reinforcement LearningDense

  11. NashDreamer: Model-Based Reinforcement Learning for Zero-Sum Imperfect-Information Games

    Sep 1, 2026Tomáš Holeček, Viliam LisýImperfect-Information GamesModel-Based Reinforcement Learning

  12. Redistribution-based Cost Inference Improves Sparse Safe Offline RL

    Aug 12, 2026Ebenezer Gelo, Geraud Nangue Tasse, Steven James +1Model-Based Reinforcement LearningTrajectory-Level Credit

  13. Unmasking Toxic Mimicry in Medical Offline Reinforcement Learning for ICU Sepsis Management via Counterfactual Clinical Audits

    Aug 11, 2026Hangqi Ren, Junyi LiaoSepsisMimic-Iv Datasets

  14. Dynamics Models for Offline Hyperparameter Selection in Real-World RL

    Aug 11, 2026Jordan Coblin, Han Wang, Martha White +1Model-Based Reinforcement LearningHyperparameter

  15. IADD-TR: Intervention-Aware Dynamics Decoupling with Targeted Regularization for Model-Based Reinforcement Learning

    Aug 11, 2026Zefeng Liang, Jie Qiao, Ruichu Cai +2Model-Based Reinforcement LearningRegularization

  16. CODS: Iterative Bellman-Residual Data Selection for Reusable Offline Reinforcement Learning

    Aug 7, 2026Ibne Farabi Shihab, Sanjeda Akter, Abu Sa-Adat Mohamed Moon-Im Al Ahsan +2Model-Based Reinforcement LearningOffline Reinforcement Learning

  17. Stochastic Multiple Shooting Trajectory Optimization via Sequential Local Policy Evaluation

    Aug 4, 2026Ashwin Gupta, Joseph MooreRobust TrajectoryModel Predictive Path Integral

  18. ReBRAC-v2: The Return of the King

    Aug 2, 2026Denis Tarasov, Robert K. KatzschmannModel-Based Reinforcement LearningSoft Actor-Critic

  19. RedFlow: Redirect Failure into Action-level Corrections for Flow-matching VLA Policy

    Jul 30, 2026Zhengyang Yan, Junhao Li, Fangqi Zhu +6Flow-Matching Vision-Language-ActionFlow Policies

  20. Learning Implicit Causal World Models from Multi-Agent Demonstrations

    Jul 28, 2026Jasorsi GhoshEfficient World-Action ModelModel-Based Reinforcement Learning

  21. A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics

    Jul 28, 2026Zheshun Wu, Renjie Zheng, Jinhang Zuo +2Model-Based Reinforcement LearningMarkov Decision Processes

  22. Online Policy Evaluation for MDPs with Dynamic UBSR Measures

    Jul 25, 2026Weikai Wang, Erick DelageConditional-Value-At-RiskMarkov Decision Processes

  23. Expert Behavior Prior Reinforcement Learning

    Jul 23, 2026Gong Gao, Weidong Zhao, Xianhui Liu +1Model-Based Reinforcement LearningOffline Reinforcement Learning

  24. Learning from World Feedback: Why Model Uncertainty Fails as a Risk Signal in Model-Based RL

    Jul 18, 2026Zhaohui WangModel-Based Reinforcement LearningProbabilistic Safety

  25. Certifiable Safe Model-Based Reinforcement Learning with Control-Affine Dynamics Approximation

    Jul 17, 2026Hao Zhou, Yanze Zhang, Cameron Reid +1Model-Based Reinforcement LearningScalable Robot Learning

  26. Evaluating covariate balance for long time horizon Markov decision processes

    Jul 16, 2026Joshua Spear, Rebecca Pope, Neil J SebireCovariate BalancingModel-Based Reinforcement Learning

  27. RENEW: Towards Learning World Models and Repairing Model Exploitation from Preferences

    Jul 15, 2026Logan Mondal Bhamidipaty, Mykel Kochenderfer, Subramanian RamamoorthyModel-Based Reinforcement LearningReinforcement Learning From Human Feedback

  28. Robo-ValueRL: Reliable Value Estimation for Offline-to-Online Reinforcement Learning

    Jul 10, 2026Wenke Xia, Pei Ren, Wenbo Yu +10Model-Based Reinforcement LearningValue Functions

  29. Shortcut Trajectory Planning for Efficient Offline Reinforcement Learning

    Jul 10, 2026Guanquan Wang, Yoshimasa TsuruokaDiffusion PlanningModel-Based Reinforcement Learning

  30. A Definition and Roadmap for World Models

    Jul 7, 2026Xinyuan Chen, Haoyu Guo, Shi Guo +10World ModelsRoadmap

  31. CDCP: Conditional Diffusion Model with Contextual Prompts for Multi-task Offline Safe Reinforcement Learning

    Jul 4, 2026Jiayi Guan, Tianle Zhang, Li Shen +8Model-Based Reinforcement LearningDiffusion Models

  32. Generalization in offline RL: The structure is more important than the amount of pessimism

    Jul 2, 2026Max Weltevrede, Matthijs T. J. Spaan, Wendelin BöhmerPessimismModel-Based Reinforcement Learning

  33. LeCropFollow: Latent Space Planning for Navigation in Unstructured Crop Fields

    Jun 30, 2026Felipe Tommaselli, Francisco Affonso, Arthur Pompeu +4Agricultural RoboticsLow-Latency Latent Planning

  34. Exploration and Online Transfer with Behavioral Foundation Models

    Jun 29, 2026Louis Bagot, Mathieu Lefort, Laëtitia MatignonModel-Based Reinforcement LearningBehavioral Foundation Models

  35. VOiLA: Vectorized Online Planning with Learned Diffusion Models for POMDP Agents

    Jun 18, 2026Marcus Hoerger, Rishikesh Joshi, Rahul Shome +2Partially Observable Markov Decision ProcessDiffusion Planning

  36. UBP2: Uncertainty-Balanced Preference Planning for Efficient Preference-based Reinforcement Learning

    Jun 17, 2026Mohamed Nabail, Leo Kaixuan Cheng, Jingmin Wang +1Model-Based Reinforcement LearningPlanning

  37. Reversal Q-Learning

    Jun 16, 2026Aditya Oberai, Seohong Park, Sergey LevineFlow PoliciesModel-Based Reinforcement Learning

  38. BRICKS-WM: Building Reusability via Interface Composition Kinetics for Structured World Models

    Jun 15, 2026Shaowei Zhang, Jiahan Cao, Xunlan Zhou +2World ModelsModel-Based Reinforcement Learning

  39. Individual Control Barrier Functions-Guided Diffusion Model for Safe Offline Multi-Agent Reinforcement Learning

    Jun 10, 2026Qingyun Guo, Junyi Shi, Jianuo Huang +1Multi-Agent Reinforcement LearningModel-Based Reinforcement Learning

  40. Safe-RULE: Safe Reinforcement UnLEarning

    Jun 8, 2026Shixiong Jiang, Taozheng Zhu, Fanxin KongModel-Based Reinforcement LearningUnsafe

  41. Counterfactual Transport Flows for Offline Conservative Trajectory Refinement

    Jun 8, 2026Lena Krieger, Xuan Zhao, Zhuo Cao +3Model-Based Reinforcement LearningLong Refinement Trajectories

  42. Representation Learning Enables Scalable Multitask Deep Reinforcement Learning

    Jun 4, 2026Johan Obando-Ceron, Lu Li, Scott Fujimoto +3Multi-Turn Reinforcement LearningModel-Based Reinforcement Learning

  43. Step-by-Step Optimization-like Reasoning in LLMs over Expanding Search Spaces

    Jun 3, 2026Nicolás Astorga, Nabeel Seedat, Mihaela van der SchaarLLM Reasoning StrategiesPrompt Optimization

  44. Post-Hoc Robustness for Model-Based Reinforcement Learning

    Jun 2, 2026Siemen Herremans, Ali Anwar, Siegfried MercelisModel-Based Reinforcement LearningOffline Reinforcement Learning

  45. All Models are Wrong, Knowing Where is Useful: On Model Uncertainty in Reinforcement Learning

    May 31, 2026Bernd Frauenknecht, Devdutt Subhasish, Artur Eisele +2Model-Based Reinforcement LearningScalable Robot Learning

  46. From Reward-Free Representations to Preferences: Rethinking Offline Preference-Based Reinforcement Learning

    May 31, 2026Jun-Jie Yang, Chia-Heng Hsu, Kui-Yuan Chen +1Reinforcement Learning From Human FeedbackModel-Based Reinforcement Learning

  47. Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning

    May 30, 2026Fuyuan Qian, Menglong Zhang, Song Wang +1Model-Based Reinforcement LearningRepresentation Learning