cs.LGSep 30, 2026

Learning Goal-Reaching Quasimetric Geometry From Finite-Time Reachability

Authors: Daisuke Yamada, Travis Pence, Vikas Singh

Organizations: Department of Computer Science University of Wisconsin–Madison · Department of Biostatistics and Medical Informatics University of Wisconsin–Madison

Abstract

In goal-conditioned reinforcement learning (GCRL), quasimetric learning models goal-reaching costs as quasimetric distances, connecting local constraints to global value geometry. Its local constraints, however, should reflect the direction- dependent effects of control composition over a finite horizon together with environmental feasibility. We propose ReQRL, which constrains the critic's value gradients through finite-horizon reachability. Drawing on state-constrained optimal control, we decouple dynamical reachability from boundary geometry, estimating both from data. On OGBench, our method outperforms or rivals existing quasimetric approaches and other offline GCRL methods.

Figures & tables

Appendix figures & tables7 assets

Supplementary material from the paper’s appendix.

Appendix

Explore similar work

CardsList
  1. Beyond Success Rates: Trainability and Extractability for Offline GCRL

    Feb 5, 2026Jan Malte Töpperwien, Aditya Mohan, Marius LindauerGoal-Conditioned Reinforcement LearningTask Success Rate

  2. Do Better Goal Representations Improve Goal-Conditioned Reinforcement Learning?

    Sep 30, 2026Syed Nazmus Sakib, Abdul Monaf Chowdhury, Nafiul Haque +2Goal-Conditioned Reinforcement LearningObject Goal Navigation