Offline-To-Online RL

RL: Reinforcement Learning

Momentum

5 papers in the last four weeks, up 67% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 40

All topics
CardsList
  1. Completion-Aware Cross-Fidelity Offline-to-Online Reinforcement Learning for Multi-Line Bus Holding

    Sep 30, 2026Yifan Zhang, Qifan Zhang, Liang ZhengRL ControlReinforcement Learning

  2. Visuomotor Robotic Pruning in Planar Orchards Using Hybrid Reinforcement Learning

    Sep 21, 2026Abhinav Jain, Cindy Grimm, Stefan LeeVisuomotor Policy LearningRobotics

  3. SCQ: Stabilizing Conservative Q-Learning with Sigmoid-Bounded Entropy

    Sep 14, 2026Xiefeng Wu, Shu Zhang, Zhaojie Chu +1Robotic RLOffline RL

  4. Real-World Reinforcement Learning with MPC Scaffolding for Dexterous Manipulation

    Sep 14, 2026Emek Barış Küçüktabak, Karankumar Patel, Zhaodong Yang +3Dexterous ManipulationContact-Rich Robotic Manipulation

  5. From Prior-Guided Heuristics to Deployable Agents: Accelerating Demonstration-Driven Reinforcement Learning for Deadline-Constrained Network Control

    Sep 3, 2026Vincenzo Norman Vitale, Mohammad Solki, Antonia Maria Tulino +2Learning from DemonstrationMulti-Agent Reinforcement Learning

  6. Learning Loco-Manipulation From SMPC Demonstrations With Sparse Offline-to-Online RL

    Aug 12, 2026Martin Schuck, Maks Sorokin, Simone Manni +5Robot Skill LearningSparse-Reward RL

  7. Do You Really Need to Pretrain Q-Functions for Online RL Fine-Tuning?

    Jul 29, 2026Perry Dong, Ron Polonsky, Dorsa Sadigh +1Continuous ControlRL Fine-Tuning

  8. A Unified Algorithmic Framework for Hybrid Reinforcement Learning in Tabular MDPs with Shifted Transition Dynamics

    Jul 28, 2026Zheshun Wu, Renjie Zheng, Jinhang Zuo +2Non-Stationary RLRegret Minimization in RL

  9. Active Offline-to-Online Reinforcement Learning

    Jul 13, 2026Alper Kamil Bozkurt, Shangtong Zhang, Yuichi MotaiOffline RLRL Fine-Tuning

  10. Robo-ValueRL: Reliable Value Estimation for Offline-to-Online Reinforcement Learning

    Jul 10, 2026Wenke Xia, Pei Ren, Wenbo Yu +10Value Function EstimationRobotic Manipulation

  11. Beyond One-Size-Fits-All: Diagnosis-Driven Online Reinforcement Learning with Offline Priors

    Jun 24, 2026Guozheng Ma, Lu Li, Zilin Wang +2Reinforcement LearningRL Post-Training

  12. Supervised Reinforcement Learning for the Coordination of Distributed Energy Resources

    Jun 23, 2026Haoyuan Deng, Yihong Zhou, Thomas Morstyn +1Reinforcement LearningRL Fine-Tuning

  13. Sim2O: Efficient Offline-to-Online MARL via Joint Action Composition

    Jun 19, 2026Bingchang Song, Yiqin YangMulti-Agent CoordinationCooperative MARL

  14. QPILOTS: Efficient Test-Time Q-Steering for Flow Policies

    Jun 11, 2026Yifan Ruan, Chenyang Cao, Andreas Burger +7Inference-Time OptimizationDiffusion Policy

  15. MODIP: Efficient Model-Based Optimization for Diffusion Policies

    Jun 9, 2026Zakariae El Asri, Philippe Gratias-Quiquandon, Nicolas Thome +1Robot Policy LearningRobot Policy Adaptation

  16. Q-VGM: Q-Guided Value-Gradient Matching for Offline-to-Online RL of Flow-Matching VLA Policies

    Jun 6, 2026Ziqian Wang, Rui Zhang, Yitian Liu +3Flow MatchingVisuomotor Policy Learning

  17. Efficient and Uncertainty-Aware Diffusion Framework for Offline-to-Online Reinforcement Learning

    May 29, 2026Ha Manh Bui, Metod Jazbec, Eric Nalisnick +1Reinforcement LearningDiffusion Policy

  18. BORA: Bridging Offline Reinforcement Learning and Online Residual Adaptation for Real-World Dexterous VLA Models

    May 28, 2026Zhongxi Chen, Yifan Han, Bin Qiu +8Contact-Rich Robotic ManipulationRobotic Manipulation

  19. Information-Directed Offline-to-Online Reinforcement Learning

    May 28, 2026Keru ChenRegret Minimization in RLBayesian RL

  20. Moment Matching Q-Learning

    May 27, 2026Yiyan, Liang, Sifei Liu +1Q-LearningOffline-To-Online RL

  21. Trust Region Q Adjoint Matching

    May 26, 2026Yonghoon Dong, Kyungmin Lee, Changyeon Kim +2Reinforcement LearningKL-Regularized RL

  22. Beyond Action Residuals: Real-World Robot Policy Steering via Bottleneck Latent Reinforcement Learning

    May 19, 2026Dongjie Yu, Kun Lei, Zhennan Jiang +2Robot Policy AdaptationReinforcement Learning

  23. ARC-RL: A Reinforcement Learning Playground Inspired by ARC Raiders

    May 19, 2026Carlo Romeo, Andrew D. BagdanovRL BenchmarksRobotics Simulation

  24. COOPO: Cyclic Offline-Online Policy Optimization Algorithm

    May 18, 2026Qisai Liu, Zhanhong Jiang, Joshua Russell Waite +3Offline RLSample-Efficient RL

  25. ROAD: Adaptive Data Mixing for Offline-to-Online Reinforcement Learning via Bi-Level Optimization

    May 14, 2026Letian Yang, Xu Liu, Yiqiang Lu +3Reinforcement LearningOffline-To-Online RL

  26. Aligning Flow Map Policies with Optimal Q-Guidance

    May 12, 2026Christos Ziakas, Alessandra Russo, Avishek Joey BoseFlow MatchingPolicy Optimization

  27. Discrete Flow Matching for Offline-to-Online Reinforcement Learning

    May 12, 2026Fairoz Nower Khan, Nabuat Zaman Nahim, Peizhong JuFlow MatchingReinforcement Learning