Vision-Language Navigation

Also known as VLN

Latest papers 194

All topics
CardsList
  1. SuperNav: An Agentic Navigation System for Any Task in Any Scene

    Oct 8, 2026Jinkai Zhang, Jingyi Xu, Yuanhong Yu +5Robot NavigationVision-Language Navigation

  2. NavGPT-3: Harnessing Context in a Hierarchical Navigation Runtime

    Oct 7, 2026Gengze Zhou, Yicong Hong, Jiazhao Zhang +9Robot NavigationVision-Language Navigation

  3. AirGroundVLN: A Large-Scale Benchmark for Goal-Oriented Air-Ground Collaborative Vision-and-Language Navigation

    Oct 7, 2026Zhenxuan Zeng, Qingle Wu, Wei Suo +4Vision-Language NavigationAerial VLN

  4. Seeing the Invisible: Physics-Guided Visual Prompting for Temperature- and Radiation-Aware VLA Navigation

    Oct 6, 2026Hojoon Son, Fan ZhangSafe Robot NavigationVision-Language Navigation

  5. What the Elevation Map Cannot See: Semantic-Aware Locomotion and Execution-Aware Navigation for Humanoid Robot

    Oct 5, 2026Shunyu Yao, Songyang Liu, Dinghao Chen +2Humanoid Robot LocomotionRobot Navigation

  6. Sim-to-Real Transfer of Vision-Language Navigation in Continuous Environments Using an Ackermann-Steered Mobile Robot

    Oct 5, 2026Chalindu Abeywansa, Sahan Gunasekara, Devindi De Silva +3VLM AdaptationSim-to-Real Transfer

  7. MarvisNav: Making Memory Visible on Route Choices for Zero-Shot Object Navigation

    Oct 5, 2026Jincheng Wang, Chi Pui Chan, Wei Zeng +3Memory-Augmented VLMsVision-Language Navigation

  8. StageVLN: Spatial and Trajectory Auxiliary Guidance for Efficient Vision-Language Navigation

    Oct 5, 2026Anh Dao, Quan-Dung Pham, Le Danh Vinh +6Vision-Language Navigation

  9. LightVLN: Efficient Aerial Vision-and-Language Navigation with Compact Memory and History-Guided Local Aggregation

    Oct 4, 2026Yiming Zhao, Tianshun Li, Jingle He +2Memory-Augmented VLMsVision-Language Models

  10. UniTrackPLA: Unified Panorama-Language-Action Model for Instruction-Guided Navigation and Dynamic Person Tracking

    Oct 1, 2026Pengfei Qi, Haoran Lin, Sizhuang Chen +7Visual Object TrackingRobot Navigation

  11. NavHarness: Adaptive Goals for Agentic Vision-Language Navigation

    Sep 30, 2026Haoxiang Shi, Zaijing Li, Muhe Ding +3Vision-Language NavigationMultimodal Agents

  12. AVERT-VLN: Abstention-aware Visual Error Recovery and Training for Vision-and-Language Navigation

    Sep 30, 2026Minrui Liu, Jingke Wang, Yuehao Huang +4Vision-Language Navigation

  13. ASENA: Self-evolving Agents for Embodied Navigation

    Sep 30, 2026An-Chieh Cheng, Isabella Liu, Edmund Bu +7Embodied NavigationLarge Language Model-Based Robot Planning

  14. Credit-Guided Policy Improvement for Test-time Adaptive Vision-Language Navigation

    Sep 29, 2026Yang Li, Sijia Zhang, Yihan Li +4Robot Policy LearningRobot Policy Adaptation

  15. Seek Before You Move: Evidence Seeking for Progress Grounding in Vision-Language Navigation

    Sep 29, 2026Zhimin Wang, Meiyuan Zhu, Duo Wu +8Vision-Language NavigationRL for VLMs

  16. Systematic Multi-Agent Vision-and-Language Navigation: Formulation, Benchmark, and Method

    Sep 28, 2026Yunzhe Xu, Zhe LiuMulti-Agent CoordinationVision-Language Navigation

  17. EdgeVLN: Runtime-Aware Deployment Ready Quantized Vision Language Navigation Model

    Sep 28, 2026Rithvik Jonna, Man Namgung, Aakash Gurram +1Visual NavigationVLM Quantization

  18. NavJev: Efficient Vision-Language Navigation via Action-Centric Visual Compression and Discriminative Action-Semantic Memory

    Sep 28, 2026Kai Sheng, Liuyi Wang, Jinlong Li +3Efficient VLM InferenceVision-Language Navigation

  19. PanoVLN: Towards Effective Panoramic Vision-and-Language Navigation

    Sep 28, 2026Zhen Wang, Changpeng Wang, Zhe Liu +5Vision-Language NavigationVLMs for Robotics

  20. VCN-Bench: A Video-Contextualized Navigation Benchmark for Spatial Reasoning over Prior Visual Experience

    Sep 28, 2026Siqi Zhang, Meng Wei, Chenyang Wan +6Visual NavigationSpatial Reasoning Benchmarks

  21. Reliability-Aware Sparse Route Memory for Round-Trip Vision-Language Navigation

    Sep 28, 2026Bojun Long, Lingfan Bao, Tianhu Peng +2Embodied NavigationRobot Navigation

  22. InfraVLA: Extending Vision-Language-Action Navigation with Infrastructure Cameras

    Sep 27, 2026Lukas Vierling, Benjamin Ramtoula, Luke Robinson +2Robot NavigationVision-Language Navigation

  23. ForeFly: A Dual-Horizon World Action Model for Aerial Vision-Language Navigation

    Sep 27, 2026Kunhui Wang, Xintong Zhang, Junyu Gao +1World Models for RoboticsUAV Navigation

  24. Affordance-Conditioned Decision Making: Bridging the Semantic-Spatial Gap in Zero-Shot Cross-Floor Vision-and-Language Navigation

    Sep 26, 2026Xuekang Yang, Lu Chen, Shuang Luo +4Vision-Language Navigation

  25. Beyond Spatial Benchmarks: From Spatial Reasoning to Navigation

    Sep 24, 2026Xun Huang, Shijia Zhao, Rongsheng Qu +5Spatial Reasoning BenchmarksRobot Policy Learning

  26. GPT-6-Astra Lights Up Embodied Navigation: Evaluation in Zero-Shot Vision-and-Language Navigation in Continuous Environments

    Sep 24, 2026Guangzhao Dai, Qianru Sun, Qi Wu +1Embodied NavigationVision-Language Navigation