Model-Based RL

RL: Reinforcement Learning

Momentum

24 papers in the last four weeks, up 243% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 142

All topics
CardsList
  1. UBP2: Uncertainty-Balanced Preference Planning for Efficient Preference-based Reinforcement Learning

    Jun 17, 2026Mohamed Nabail, Leo Kaixuan Cheng, Jingmin Wang +1Pairwise Preference EvaluationRL Exploration

  2. Stealthy World Model Manipulation via Data Poisoning

    Jun 17, 2026Yibin Hu, Xiaolin Sun, Zizhan ZhengWorld Model LearningAdversarial Attacks

  3. SRL: Combining SLIP Model and Reinforcement Learning for Agile Robotic Jumping

    Jun 17, 2026Xiaowen Hu, Linqi Ye, Yudi Zhu +4Robot LocomotionRL for Legged Locomotion

  4. WAM-RL: World-Action Model Reinforcement Learning with Reconstruction Rewards and Online Video SFT

    Jun 16, 2026Zezhong Qian, Xiaowei Chi, Yu Qi +3World Model LearningAction-Conditioned World Models

  5. BRICKS-WM: Building Reusability via Interface Composition Kinetics for Structured World Models

    Jun 15, 2026Shaowei Zhang, Jiahan Cao, Xunlan Zhou +2World ModelsLatent World Models

  6. SafeDojo: Safe Reinforcement Learning for VLA via Interactive World Model

    Jun 15, 2026Kai Tang, Peidong Jia, Zhong Chu +15Constrained RLRobot Safety

  7. Causal Object-Centric Models for Planning with Monte Carlo Tree Search

    Jun 12, 2026Rodion Vakhitov, Leonid Ugadiarov, Alexey Skrynnik +1World ModelsWorld Model-Based Planning

  8. PLUME: Probabilistic Latent Unified World Modeling and Parameter Estimation for Multi-Finger Manipulation

    Jun 9, 2026Abhinav Kumar, Soshi Iba, Rana Soltani Zarrin +1Online System IdentificationDexterous Manipulation

  9. MODIP: Efficient Model-Based Optimization for Diffusion Policies

    Jun 9, 2026Zakariae El Asri, Philippe Gratias-Quiquandon, Nicolas Thome +1Robot Policy LearningRobot Policy Adaptation

  10. MARCH: Model-Assisted Reinforcement Learning for the Perceptive Control of Humanoids over Sparse Footholds

    Jun 9, 2026Codrin Crismariu, Ryan K. CosnerHumanoid Robot LocomotionTerrain-Aware Robot Locomotion

  11. Learning Explicit Behavioral Models with Adaptive Questions and World-Model Probes

    Jun 5, 2026Hikaru Shindo, Yu Deng, Teng Cao +5Reinforcement LearningWorld Models

  12. Post-Hoc Robustness for Model-Based Reinforcement Learning

    Jun 2, 2026Siemen Herremans, Ali Anwar, Siegfried MercelisAdversarial RobustnessRobust RL

  13. Minimax-Optimal Policy Regret in Partially Observable Markov Games

    Jun 1, 2026Raman AroraRegret Minimization in RLImperfect-Information Games

  14. All Models are Wrong, Knowing Where is Useful: On Model Uncertainty in Reinforcement Learning

    May 31, 2026Bernd Frauenknecht, Devdutt Subhasish, Artur Eisele +2Robotic RLSafe RL

  15. Behavior-Invariant Task Representation Learning with Transformer-based World Models for Offline Meta-Reinforcement Learning

    May 30, 2026Fuyuan Qian, Menglong Zhang, Song Wang +1Representation LearningOffline RL

  16. Regularized Offline Policy Optimization with Posterior Hybrid Bayesian Belief

    May 30, 2026Hongqiang Lin, Pengfei Wang, Nenggan ZhengReinforcement LearningBayesian RL

  17. Cortex and subcortex play distinct roles over learning when cortical memory is limited

    May 30, 2026Matthew Farrell, Taro ToyoizumiComputational Cognitive ModelingReinforcement Learning

  18. StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement

    May 29, 2026Junwon Seo, Sushant Veer, Ran Tian +6Video Diffusion ModelsAction-Conditioned World Models

  19. Efficient and Uncertainty-Aware Diffusion Framework for Offline-to-Online Reinforcement Learning

    May 29, 2026Ha Manh Bui, Metod Jazbec, Eric Nalisnick +1Reinforcement LearningDiffusion Policy

  20. Theoretical Foundations and Effective Algorithms for Policy-Aware Simulator Learning

    May 27, 2026Christoph Dann, Yishay Mansour, Mehryar MohriSim-to-Real TransferActive Learning

  21. Accelerating Reinforcement Learning Training Using Simulation Surrogate Models

    May 26, 2026Mohammadmahdi Ghasemloo, David J. Eckman, Yaxian LiSurrogate ModelingReinforcement Learning

  22. Scaling World-Model Reinforcement Learning Through Diffusion Policy Optimization

    May 25, 2026Xiaoyuan Cheng, Wenxuan Yuan, Zhancun Mu +5World Model LearningDiffusion Policy

  23. Generative OOD-regularized Model-based Policy Optimization

    May 23, 2026Aysin Tumay, Jiahe Huang, Elise Jortberg +1Offline RLOOD Detection

  24. Neuro-Inspired Inverse Learning for Planning and Control

    May 22, 2026Maryna Kapitonova, Tonio BallRobot Policy LearningModel-Based Planning

  25. Dreaming Smoothly and Sample Efficiently with Gradient Penalized Latent Dynamics

    May 21, 2026Romil V. Sonigra, P. R. KumarLatent Dynamics ModelingJacobian Regularization

  26. Offline Reinforcement Learning for Plasma Control in Nuclear Fusion: Codebase and Benchmark

    May 19, 2026Yang Fu, Haomin Bao, Rohit Sonker +4RL BenchmarksOffline RL

  27. Sampling-Based Safe Reinforcement Learning

    May 19, 2026Luca Vignola, Bruce D. Lee, Manish Prajapat +4Robot SafetySafe RL

  28. PH-Dreamer: A Physics-Driven World Model via Port-Hamiltonian Generative Dynamics

    May 18, 2026Xueyu Luan, Chenwei ShiDynamical SystemsReinforcement Learning

  29. Transfer Learning for Customized Car Racing Environments

    May 18, 2026Benedict Florance Arockiaraj, Richard Chang, Wesley YeeAutonomous RacingCross-Domain Transfer Learning