Robotic RL

RL: Reinforcement Learning

Momentum

28 papers in the last four weeks, up 180% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 184

All topics
CardsList
  1. FlowDPG: Deterministic Policy Gradient on Flow Matching Policies for Real-World Manipulation

    Jun 21, 2026Kexin Shi, Junyao Shi, Poorvi Hebbar +5Flow MatchingPolicy Gradient

  2. RARM: Confidence-Gated Progress Reward Modeling for RL in Manipulation

    Jun 20, 2026Pengzhi Yang, Xinyu Wang, Pengyu Jing +7Long-Horizon Robotic ManipulationRobot Skill Learning

  3. A Reward-Petri-Net Interpretation of Temporal Behavior Trees

    Jun 19, 2026Till Schmeil, Günther Waxenegger-Wilfing, Sebastian SchirmerReinforcement LearningReward Shaping

  4. DF-ExpEnse: Diffusion Filtered Exploration for Sample Efficient Finetuning

    Jun 17, 2026Calvin Luo, Chen Sun, Shuran SongRobot Policy AdaptationRobotic RL

  5. Recover, Discover, Plan: Learning Skills and Concepts from Robot Failures

    Jun 16, 2026Bowen Li, Mayank Mishra, Y. Isabel Liu +7Robot Skill LearningGeneralization in Robotic Manipulation

  6. Hierarchical Advantage Weighting for Online RL Fine-Tuning of VLAs from Sparse Episode Outcomes

    Jun 15, 2026Tongyan Fang, Siyuan Huang, Naiyu Fang +6Credit Assignment in RLRobotic RL

  7. Task-Error Residual Learning for Real-Robot Five-Ball Juggling

    Jun 15, 2026Kai Ploeger, Jan PetersRobotic ControlRobot Skill Learning

  8. Steering Generative Reinforcement Learning into Stable Robotic Controller

    Jun 15, 2026Yixuan Wang, Shutong Ding, Ke Hu +3Latent Action LearningRobotic RL

  9. Agile Fall Recovery for Quadrotors with Bidirectional Thrust via Reinforcement Learning

    Jun 15, 2026Anke Zhao, Yuhang Zhong, Kenghou Hoi +5Robot Failure RecoveryRobotic RL

  10. Energy-Efficient Arm Reaching for a Humanoid Robot via Deep Reinforcement Learning with Identified Power Models

    Jun 14, 2026Nestor N. Deniz, Simon Parsons, Fernando Auat CheeinRobotic ControlHumanoid Robot Control

  11. Hy-Embodied-0.5-VLA: From Vision-Language-Action Models to a Real-World Robot Learning Stack

    Jun 12, 2026He Zhang, Lingzhu Xiang, Haitao Lin +23Robotic RLVision-Language-Action Models

  12. UniIntervene: Agentic Intervention for Efficient Real-World Reinforcement Learning

    Jun 10, 2026Haoyuan Deng, Yitong Gao, Yudong Lin +3Agentic RLReinforcement Learning

  13. KinematicRL: A Sim-to-Real Reinforcement Learning Framework For Social Navigation With Kinodynamic Feasibility

    Jun 10, 2026Zhiming Xu, Haodong Yang, Chengju Liu +2Kinodynamic Motion PlanningSim-to-Real Transfer

  14. PAWS: Preference Learning with Advantage-Weighted Segments

    Jun 10, 2026Aleksandar Taranovic, Onur Celik, Niklas Freymuth +6Credit Assignment in RLRobotic RL

  15. Dynamic Execution Horizon Prediction for Chunk-based Robot Policies

    Jun 9, 2026Yuchi Zhao, Miroslav Bogdanovic, Arjun Sohal +5Robot Policy LearningLong-Horizon Robotic Manipulation

  16. ReGIL: Retrieval-Guided Imitation Learning from a Single Demonstration

    Jun 8, 2026Yuying Zhang, Francesco Verdoja, Wenyan Yang +1Robot Skill LearningRobotic RL

  17. IR-SIM: A Lightweight Declarative Simulator for Navigation Learning and Benchmarking

    Jun 7, 2026Ruihua Han, Shuai Wang, Chengyang Li +8Robotics SimulationRobot Navigation

  18. HARBOR: A Harness Framework for Agentic Robot Reinforcement Learning

    Jun 7, 2026Zechu Li, Yufeng Jin, Xiaoyang Liu +4Agentic RLReinforcement Learning

  19. Reinforcement Learning for Flow-Matching Policies with Density Transport

    Jun 7, 2026Boshu Lei, Kostas Daniilidis, Antonio LoquercioFlow MatchingRobotic RL

  20. ActProbe: Action-Space Probe for Early Failure Detection of Generative Robot Policies

    Jun 7, 2026Bingjia Huang, Xiangyu Li, Xiang Wang +7Robot Policy LearningRobot Failure Detection

  21. Learning All-Terrain Locomotion for a Planetary Rover with Actively Articulated Suspension

    Jun 5, 2026Arthur Bouton, Tristan D. Hasseler, Michael Paton +5Off-Road Robot NavigationRobotic RL

  22. L-SDPPO: Policy Optimization of Spiking Diffusion Policy for Intra-vehicular Robotic Manipulation

    Jun 4, 2026Liwen Zhang, Dong Zhou, Guanghui Sun +4Space RoboticsRobotic RL

  23. MoDex: A Diffusion Policy for Sequential Multi-Object Dexterous Grasping

    Jun 3, 2026Haofei Lu, Hongjia Liu, Yifei Dong +3Robotic GraspingRobotic RL

  24. Preference-Calibrated Human-in-the-Loop Reinforcement Learning for Robotic Manipulation

    Jun 2, 2026Zeyi Liu, Guangyao Liu, Yinuo Qu +6Credit Assignment in RLRobotic RL

  25. GN0: Toward a Unified Paradigm for Generation, Evaluation, and Policy Learning in Visual-Language Navigation

    Jun 2, 2026Xinhai Li, Xiaotao Zhang, Yuehao Huang +10Robot Policy LearningEmbodied Navigation

  26. A GPU-Parallel Framework for Heterogeneous Multi-Task Reinforcement Learning

    Jun 2, 2026Rui Zhang, Qiwei Wu, Zhengyu Zhang +7Robotic RLLearning from Demonstration

  27. Dynamics Are Learned, Not Told: Semi-Supervised Discovery of Latent Dynamics Geometries For Zero-Shot Policy Adaptation

    Jun 1, 2026Zhiming Xu, Weitao Zhou, Xianghui Pan +4Robot Policy AdaptationLatent Dynamics Modeling