Vision-Language Navigation

Latest papers 184

All topics
CardsList
  1. MarvisNav: Making Memory Visible on Route Choices for Zero-Shot Object Navigation

    Oct 5, 2026Jincheng Wang, Chi Pui Chan, Wei Zeng +3Vision-Language Navigation

  2. StageVLN: Spatial and Trajectory Auxiliary Guidance for Efficient Vision-Language Navigation

    Oct 5, 2026Anh Dao, Quan-Dung Pham, Le Danh Vinh +6Vision-Language Navigation

  3. STARS: From Spatiotemporal Dynamics to Social Representations in Human-Robot Interaction

    Sep 30, 2026Nathan Tsoi, Michael J. Munje, Tejas Oberoi +5Vision-Language NavigationRobot Navigation

  4. NavHarness: Adaptive Goals for Agentic Vision-Language Navigation

    Sep 30, 2026Haoxiang Shi, Zaijing Li, Muhe Ding +3Vision-Language NavigationNavigation

  5. AVERT-VLN: Abstention-aware Visual Error Recovery and Training for Vision-and-Language Navigation

    Sep 30, 2026Minrui Liu, Jingke Wang, Yuehao Huang +4Vision-Language NavigationProcess-Level Supervision

  6. ASENA: Self-evolving Agents for Embodied Navigation

    Sep 30, 2026An-Chieh Cheng, Isabella Liu, Edmund Bu +7Embodied AgentsVision-Language Navigation

  7. Credit-Guided Policy Improvement for Test-time Adaptive Vision-Language Navigation

    Sep 29, 2026Yang Li, Sijia Zhang, Yihan Li +4Vision-Language NavigationTrajectory-Level Credit

  8. Seek Before You Move: Evidence Seeking for Progress Grounding in Vision-Language Navigation

    Sep 29, 2026Zhimin Wang, Meiyuan Zhu, Duo Wu +8Vision-Language NavigationNavigation

  9. Systematic Multi-Agent Vision-and-Language Navigation: Formulation, Benchmark, and Method

    Sep 28, 2026Yunzhe Xu, Zhe LiuVision-Language NavigationObject Goal Navigation

  10. EdgeVLN: Runtime-Aware Deployment Ready Quantized Vision Language Navigation Model

    Sep 28, 2026Rithvik Jonna, Man Namgung, Aakash Gurram +1Vision-Language NavigationResource-Constrained Edge Devices

  11. NavJev: Efficient Vision-Language Navigation via Action-Centric Visual Compression and Discriminative Action-Semantic Memory

    Sep 28, 2026Kai Sheng, Liuyi Wang, Jinlong Li +3Vision-Language NavigationDiffusion-Based Vision-Language-Actions

  12. PanoVLN: Towards Effective Panoramic Vision-and-Language Navigation

    Sep 28, 2026Zhen Wang, Changpeng Wang, Zhe Liu +5Vision-Language NavigationRecent Vision-Language Models

  13. VCN-Bench: A Video-Contextualized Navigation Benchmark for Spatial Reasoning over Prior Visual Experience

    Sep 28, 2026Siqi Zhang, Meng Wei, Chenyang Wan +6Vision-Language NavigationObject Goal Navigation

  14. Reliability-Aware Sparse Route Memory for Round-Trip Vision-Language Navigation

    Sep 28, 2026Bojun Long, Lingfan Bao, Tianhu Peng +2Vision-Language Navigation

  15. Affordance-Conditioned Decision Making: Bridging the Semantic-Spatial Gap in Zero-Shot Cross-Floor Vision-and-Language Navigation

    Sep 26, 2026Xuekang Yang, Lu Chen, Shuang Luo +4Vision-Language NavigationClassical Planning

  16. GPT-6-Astra Lights Up Embodied Navigation: Evaluation in Zero-Shot Vision-and-Language Navigation in Continuous Environments

    Sep 24, 2026Guangzhao Dai, Qianru Sun, Qi Wu +1Vision-Language NavigationEmbodied Artificial Intelligence

  17. Hierarchical Floorplan-Guided Vision-Language Exploration for Embodied Question Answering

    Sep 22, 2026Albert Gassol Puigjaner, Kostas AlexisVision-Language NavigationKnowledge-Based Visual Question Answering

  18. What do VLM-Based Vision-Language Navigation Models Rely on: Interpreting and Steering Policy Behavior

    Sep 21, 2026Débora Oliveira Makowski, Samiran Gode, Abhijeet Nayak +4Vision-Language NavigationVision-Language Foundation Models

  19. A Topological Representation with Object-Path Graphs for Open-Vocabulary Instance Navigation

    Sep 21, 2026Linwei Zheng, Daojie Peng, Bingtao Wang +2Vision-Language NavigationNavigation

  20. Spatial-Semantic Uncertainty in VLM-Based Target Search: Balancing Exploration and Identification

    Sep 17, 2026Alkesh K. Srivastava, Jonathan Diller, Vijay Kumar +1Vision-Language NavigationLow-Latency Latent Planning

  21. Navi-Agent: Unlocalized Monocular Navigation Agent

    Sep 17, 2026Wenyuan Xie, Mengyang Hong, Yongzhong Wang +9Vision-Language NavigationSafe Navigation

  22. GPT-6-Astra in a Navigation Workflow: Behavioral Analysis in Zero-Shot Vision-and-Language Navigation in Continuous Environments

    Sep 17, 2026Guangzhao Dai, Qi Wu, Bin ZhuVision-Language NavigationOpenai

  23. AdaGeoVLN: Selective Geometry Across Representation Depth and Navigation Time for Vision-Language Navigation

    Sep 16, 2026Quan-Dung Pham, Anh Dao, Danh Vinh Le +7Vision-Language NavigationRepresentation Quality

  24. GroundingVLN: Reasoning and Acting with Grounding for Vision-Language Navigation

    Sep 16, 2026Kailing Li, Yu Han, Tianwen Qian +4Vision-Language NavigationGrounding

  25. ENCP: Episode-Normalized Conformal Prediction for Vision-and-Language Navigation

    Sep 15, 2026Vicky Feliren, A. Taufiq Asyhari, Muhamad Risqi U. SaputraVision-Language NavigationLarge Language Model Uncertainty

  26. AnchorGUI: Asymmetric Memory for Dual-Scale Learning in GUI Navigation

    Sep 14, 2026Shengjie Jin, Zelong Sun, Hengbo Xu +2Graphical User InterfaceVision-Language Navigation

  27. HarnessVLN: Unifying Training-Free Embodied Navigation through an Agent Harness

    Sep 14, 2026Yang Chen, Lirong Che, Zhenyu Huang +7Vision-Language NavigationEmbodied Agents

  28. C2^2Nav: Compare Before You Commit for Zero-Shot Vision-and-Language Navigation

    Sep 14, 2026Runtian Zheng, Congpeng Zhang, Ying LiuVision-Language NavigationNavigation

  29. LG-VLN: A Zero-Shot Vision-and-Language Navigation Framework with LangGraph State Orchestration

    Sep 14, 2026Jianhe Zhao, Yanhua Qiu, Zhiyu Zhang +2Vision-Language NavigationNavigation

  30. AnchorVLN: Geometry-Anchored Vision-Language Grounding Reasoning for Open-Vocabulary Navigation

    Sep 14, 2026Long Giang Vu, Chengkai Yao, Yuxin Liu +2Vision-Language NavigationNavigation

  31. Assisted Spatial Cognition Through Vision-Language Models

    Sep 14, 2026H. Riaz, J. B. Fernandez, I. Mills +3Vision-Language Navigation3D Spatial Reasoning

  32. TANGO: Humanoid Navigation in Cluttered Environments with a Whole-Body Vision-Language-Action Model

    Sep 8, 2026Anqi Li, Yuxin Chen, Zhaobo Li +4Vision-Language NavigationDiffusion-Based Vision-Language-Actions

  33. Estimating Semantic Ambiguity via Gaussian Context Distributions for VLM-Driven Traversability Analysis

    Sep 8, 2026Ramona Häuselmann, Mario A. V. Saucedo, Christoforos Kanellakis +1TraversabilityVision-Language Navigation

  34. Revisiting Topological Graphs for Macro Action based Closed-loop Reinforcement Learning of Vision Language Navigation in Continuous Environment

    Sep 3, 2026Shuhao Ye, Sitong Mao, Yuxiang Cui +7Vision-Language NavigationAction Space

  35. VerNav: Verifier-First Low-Latency Vision-and-Language Navigation

    Sep 1, 2026Zhixin Wang, Chengzheyi Yao, Leyuan Liu +2Vision-Language NavigationReinforcement Fine-Tuning

  36. HumanoidVLN: A Physics-Grounded Simulator and Benchmark for Vision-Language Navigation Across Diverse Humanoid Embodiments

    Aug 13, 2026Quan-Dung Pham, Anh Dao, The-Anh Nguyen +8Vision-Language NavigationHumanoid

  37. AECNav: Active Evidence Consolidation for Efficient Zero-Shot Open-Vocabulary Object Navigation

    Aug 11, 2026Guanlin Liu, Shaobin Ling, Renyuan Liu +2Vision-Language NavigationObject Goal Navigation

  38. Hierarchical Fast-Slow ReAct Agent for Zero-Shot Object-Goal Navigation

    Aug 10, 2026Zhaochen Lan, Zhi Yang, Yuxiang Fu +1Vision-Language NavigationObject Goal Navigation

  39. SAIN: Structure-Aware Interactive Navigation with Active Dialogue Grounding for Mobile Robot

    Aug 10, 2026Yuhao Cao, Xiao Liu, Yang Xie +2Vision-Language NavigationObject Goal Navigation

  40. Goal-oriented Navigation Instruction Generation with Tour Video Priors

    Aug 9, 2026Fangdi Li, Juncheng Liao, Changxu Cheng +4Vision-Language NavigationObject Goal Navigation

  41. WNM-3D: A World Navigation Model with 3D Scene Conditioning for Closed-Loop VLN

    Aug 7, 2026Yuehao Huang, Yunzi Wu, Xiaotao Zhang +7Vision-Language NavigationEfficient World-Action Model

  42. LifelongCrossNav: Persistent 3D Semantic Memory for Cross-Floor Multi-Object Navigation

    Aug 7, 2026Zehui Li, Zihao Sun, Jiawei Xu +6Object Goal NavigationVision-Language Navigation

  43. CrossTracer: Cross-Embodiment Navigation via VLA Model Reasoning and Trace Residuals Adapting

    Aug 7, 2026Yao Wang, Siyuan Wang, Zhirui Sun +4Vision-Language NavigationCross-Embodiment Transfer

  44. From Routes to Steps: Separating Semantic Progress from Local Execution in Vision-and-Language Navigation

    Aug 4, 2026Xiangyun Huang, Xiangchen Wang, Runfeng Lin +5Vision-Language NavigationNavigation

  45. CoNav-UAV: Cooperative Dual-Altitude Aerial Navigation via Stackelberg Learning

    Aug 3, 2026Junru Song, Wenhao Zhang, Yang Yang +7Aerial Vision-Language NavigationMulti-Uav

  46. AeroDPO: Unleashing Lightweight UAV Navigation with High-Fidelity Perception and Automated Preference Optimization

    Aug 2, 2026Peng Xu, Chengcheng Wang, Shaohua WanAerial Vision-Language NavigationUnmanned Aerial Vehicles

  47. SC2^{2}-WM: A Self-Correcting World Model with Closed-Loop Feedback for Vision-and-Language Navigation in Continuous Environments

    Aug 1, 2026Xuan Yao, Yuze Zhu, Junyu Gao +2Vision-Language NavigationObject Goal Navigation

  48. HAM-VLN: Harnessing Hierarchical Agentic Memory for Zero-Shot Vision-and-Language Navigation

    Jul 31, 2026An Liu, Bingxi Liu, Hongyu Ding +6Vision-Language NavigationAgentic Memory

  49. TEA-AgriVLN: Traversability Estimation Alarm for Agricultural Vision-and-Language Navigation

    Jul 30, 2026Xiaobei Zhao, Xingqi Lyu, Xin Chen +1Vision-Language NavigationTraversability

  50. Embodied Agents Take Control: Minimal-Interface Zero-Shot Agents Rival Industrial-Scale Policies in Vision-and-Language Navigation

    Jul 28, 2026Jian Zhou, Xunyi Zhao, Gengze Zhou +4Embodied AgentsVision-Language Navigation

  51. Room-Mediated Co-occurrence for Zero-Shot Object-Centric Semantic Navigation via Frontier Scoring

    Jul 28, 2026Adam Scicluna, Gavin Paul, Alen AlempijevicVision-Language NavigationObject Goal Navigation

  52. IMPRINT: Image-Conditioned Query Enrichment for Long-Tail Object Goal Navigation

    Jul 27, 2026Jelin Raphael Akkara, Filippo Ziliotto, Luciano Serafini +2Vision-Language NavigationSemantic Mapping

  53. MemVLN: Episodic and Procedural Memory for Vision-and-Language Navigation

    Jul 26, 2026Yuqi Liu, Shengju Qian, Tianyuan Qu +5Vision-Language NavigationDiffusion-Based Vision-Language-Actions

  54. Towards Dual-Brain Minimal Sufficient Representation for Vision-Language Navigation

    Jul 25, 2026Yihao Wu, Chenyi Xu, Liqi Yan +6Vision-Language NavigationNavigation

  55. Offline Vision-Language Navigation with Geometric Goal Localization for Outdoor Environments

    Jul 24, 2026Ali Salmasi, Xianjia Yu, Tomi WesterlundVision-Language NavigationRobot Navigation