Goal-Conditioned RL

RL: Reinforcement Learning

Momentum

13 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 70

All topics
CardsList
  1. Q-Shaped Options for Hierarchical Reinforcement Learning

    Oct 8, 2026Clarisse Wibault, Antoine Gorceix, Antonio Léon Villares +5Hierarchical RLRepresentation Learning for RL

  2. World-Model Policy Arbiter for Goal-Conditioned Reinforcement Learning

    Oct 7, 2026Junwei Quan, Evgenii Opryshko, Nicholas Rhinehart +1Goal-Conditioned RLOffline RL

  3. An Informational Curse of Horizon in Goal-Conditioned Policy Learning

    Oct 7, 2026John L. Zhou, Yuxuan Dong, Jonathan C. KaoGoal-Conditioned RLGeneralization in RL

  4. Directed Temporal Representations for Offline Visual Control

    Oct 6, 2026Chenyang Yuan, Haoyu Wang, Zhuo Sun +1Visual RLTrajectory Representation Learning

  5. Hierarchical Time-aware Bootstrapping for Off-Policy Subgoal Value Learning

    Oct 4, 2026Bingyun Liu, Yuheng JingHierarchical RLTemporal-Difference Learning

  6. Direction-Conditioned Policies for Online Goal-Conditioned Reinforcement Learning

    Oct 4, 2026S K Swaminathan, Damiya Gondha, Theyanesh Eswaramoorthy Rajahkrishnan +1Reinforcement LearningContrastive RL

  7. Learning Multiple Timescales for Goal-Conditioned Reinforcement Learning

    Oct 1, 2026Pedro Robles Dutenhefner, Dikshant Shehmar, Wagner Meira +1Reinforcement LearningOffline RL

  8. Learning Goal-Reaching Quasimetric Geometry From Finite-Time Reachability

    Sep 30, 2026Daisuke Yamada, Travis Pence, Vikas SinghMetric LearningOffline RL

  9. Do Better Goal Representations Improve Goal-Conditioned Reinforcement Learning?

    Sep 30, 2026Syed Nazmus Sakib, Abdul Monaf Chowdhury, Nafiul Haque +2Offline RLRepresentation Learning for RL

  10. EVOKE: Eliciting World Knowledge in Agents for Transferable Decision-Making

    Sep 29, 2026Yuhan Guo, Jinming Liu, Liang Xu +8LLM Agent TrainingGeneralization in RL

  11. ChronoSRL: Temporal Geometry for Self-Supervised Reinforcement Learning

    Sep 28, 2026Nico Bohlinger, Jan PetersRL for RoboticsRepresentation Learning

  12. Diffusion Subgoal Planning for Long-Horizon Offline Goal-Conditioned Reinforcement Learning

    Sep 28, 2026Hengrui Zhang, Yuhu Cheng, C. L. Philip Chen +1Diffusion-Based PlanningHierarchical RL

  13. GTRL: Grounding Divide-and-Conquer Value Learning with Temporal Differences

    Sep 27, 2026Abdul Monaf Chowdhury, MD Sameer Iqbal Chowdhury, Shifat E Arman +1Reinforcement LearningTemporal-Difference Learning

  14. Topological Necessities: Mechanism-Invariant Strategic Subgoals for Cross-Embodiment Goal-Conditioned Control

    Sep 12, 2026Hao Shi, Xi LiHierarchical RLCross-Embodiment Robot Learning

  15. From Connectivity to Rewards: Dense Reward Learning with Directed State Graphs

    Sep 11, 2026Shuyuan Zhang, Zihan Wang, Xiao-Wen Chang +1Reinforcement LearningHierarchical RL

  16. SUN: Reaching for Novelty in Reinforcement Learning

    Sep 8, 2026Wenyan Yang, Arsenii Mustafin, Dominik Baumann +2Intrinsic MotivationRL Exploration

  17. Locally-Guided Actor-Critic: Training a Goal-conditioned Actor with a Subgoal-aware Critic

    Aug 31, 2026Olivier Serris, Stéphane Doncieux, Olivier SigaudReinforcement LearningSparse-Reward RL

  18. Enhancing Social Intelligence in LLMs with Hierarchical Reasoning and Utterance-Level Goal Rewarding

    Aug 6, 2026Xiaofeng Wang, Kakam Chong, Shuai Xiao +9Reward ShapingHierarchical RL

  19. State2State: Environment-Derived Mid-Training for LLM Agents

    Aug 5, 2026Xuanyu Lei, Yiqi Zhu, Chenliang Li +6LLM Agent TrainingGoal-Conditioned RL

  20. ATLAS: Adaptive Topological Learning with Abstract Successors for Continual Learning

    Aug 5, 2026R. Blake Lawlor, Daniel S. BrownNon-Stationary RLReinforcement Learning

  21. Action-Conditioned World Model for Goal Plane Probe Guidance in Robotic Ultrasound

    Jul 24, 2026Siqi Fan, Mingcong Chen, Ran Liu +5World Model LearningAction-Conditioned World Models

  22. Offline RL with Hierarchical Action Chunking

    Jul 23, 2026Ahad JawaidHierarchical RLOffline RL

  23. DAGR: State-Conditioned Goal Representations via Difference-Aware Goal Cross-Attention

    Jul 15, 2026Xing Lei, Wenyan Yang, Xuetao Zhang +1Reinforcement LearningAttention Mechanisms

  24. RoamFlow: Reinforcement-Aligned One-Step Action MeanFlow Policy for Image-Goal Navigation

    Jun 29, 2026Zixuan Zhang, Yuqi Chen, Junjie Gao +4Visual NavigationRobot Navigation

  25. CORE: Common Outcome Regularities from Action-Free Visual Demonstrations for Robot Manipulation

    Jun 28, 2026Juyi Sheng, Jincheng Li, Mingxin Tan +1Robot Skill LearningCross-Embodiment Robot Learning

  26. Humanoid-DART: Humanoid Loco-Manipulation using Diffusion-guided Augmentation through Relabeling and Tracking

    Jun 25, 2026Pranav Debbad, Kanish Thiagarajan, Victor Dhédin +2Humanoid Loco-ManipulationRobot Imitation Learning

  27. Inverting the Bellman Equation: From QQ-Values to World Models

    Jun 19, 2026Alistair Letcher, Mattie Fellows, Alexander D. Goldie +3Reinforcement LearningModel-Free RL

  28. Direction-Conditioned Policies via Compositional Subgoal Scoring for Online Goal-Conditioned Reinforcement Learning

    Jun 15, 2026Swaminathan S K, Damiya Gondha, Theyanesh Eswaramoorthy Rajahkrishnan +1Contrastive RLPolicy Learning