Vision-Language Navigation

Also known as VLN

Latest papers 194

All topics
CardsList
  1. SEDualVLN: A Spatially-Enhanced Dual-System for Vision-Language Navigation

    May 17, 2026Jingzhi Huang, Junkai Huang, Wenxuan Song +4Visual Spatial ReasoningVision-Language Navigation

  2. WorldVLN: Autoregressive World Action Model for Aerial Vision-Language Navigation

    May 15, 2026Baining Zhao, Jiacheng Xu, Weicheng Feng +13World Model LearningVision-Language Navigation

  3. Exploring Bottlenecks in VLM-LLM Navigation: How 3D Scene Understanding Capability Impacts Zero-Shot VLN

    May 14, 2026Ziyi Xia, Chaoran Xiong, Litao Wei +2Vision-Language Navigation3D Scene Understanding

  4. What Limits Vision-and-Language Navigation ?

    May 13, 2026Yunheng Wang, Yuetong Fang, Taowen Wang +9Sim-to-Real TransferVision-Language Navigation

  5. HCSG: Human-Centric Semantic-Geometric Reasoning for Vision-Language Navigation

    May 13, 2026Haoxuan Xu, Tianfu Li, Wenbo Chen +7Social Robot NavigationVision-Language Navigation

  6. SleepWalk: A Three-Tier Benchmark for Stress-Testing Instruction-Guided Vision-Language Navigation

    May 11, 2026Niyati Rawal, Sushant Ravva, Shah Alam Abir +5VLM EvaluationSpatial Reasoning Benchmarks

  7. LCGNav: Local Candidate-Aware Geometric Enhancement for General Topological Planning in Vision-Language Navigation

    May 9, 2026Jiankun Peng, Jianyuan Guo, Yiguang Yang +3Vision-Language Navigation

  8. NavOne: One-Step Global Planning for Vision-Language Navigation on Top-Down Maps

    May 7, 2026Dijia Zhan, Jinyi Li, Chenxi Zheng +4Vision-Language NavigationMotion Planning

  9. A Semantic Autonomy Framework for VLM-Integrated Indoor Mobile Robots: Hybrid Deterministic Reasoning and Cross-Robot Adaptive Memory

    May 4, 2026Bogdan Felician Abaza, Andrei-Alexandru Staicu, Cristian Vasile DoicinMobile RoboticsVision-Language Navigation

  10. Action Agent: Agentic Video Generation Meets Flow-Constrained Diffusion

    May 2, 2026Jeffrin Sam, Nguyen Khang, Yara Mahmoud +2Trajectory GenerationDiffusion-Based Planning

  11. MiniVLA-Nav v1: A Multi-Scene Simulation Dataset for Language-Conditioned Robot Navigation

    May 1, 2026Ali Al-Bustami, Jaerock KwonRobotic Data CollectionRobotics Simulation

  12. SpaAct: Spatially-Activated Transition Learning with Curriculum Adaptation for Vision-Language Navigation

    Apr 30, 2026Pengna Li, Kangyi Wu, Shaoqing Xu +7VLM AdaptationVision-Language Navigation

  13. Three-Step Nav: A Hierarchical Global-Local Planner for Zero-Shot Vision-and-Language Navigation

    Apr 29, 2026Wanrong Zheng, Yunhao Ge, Laurent IttiVision-Language Navigation

  14. Walk With Me: Long-Horizon Social Navigation for Human-Centric Outdoor Assistance

    Apr 29, 2026Lingfeng Zhang, Xiaoshuai Hao, Xizhou Bu +11Robot NavigationSafe Robot Navigation

  15. Where Did It Go Wrong? Capability-Oriented Failure Attribution for Vision-and-Language Navigation Agents

    Apr 28, 2026Jianming Chen, Yawen Wang, Junjie Wang +4Agent Failure AnalysisAI Agent Evaluation

  16. FreqCache: Accelerating Embodied VLN Models with Adaptive Frequency-Guided Token Caching

    Apr 27, 2026Zihao Zheng, Xingyue Zhou, Zhihao Mao +7Efficient VLM InferenceVision-Language Navigation

  17. DM3^3-Nav: Decentralized Multi-Agent Multimodal Multi-Object Semantic Navigation

    Apr 23, 2026Amin Kashiri, Atharva Jamsandekar, Yasin YazıcıoğluVision-Language NavigationMulti-Robot Coordination

  18. A Deployable Embodied Vision-Language Navigation System with Hierarchical Cognition and Context-Aware Exploration

    Apr 23, 2026Kuan Xu, Ruimeng Liu, Yizhuo Yang +5Robot NavigationVision-Language Navigation

  19. LiveVLN: Breaking the Stop-and-Go Loop in Vision-Language Navigation

    Apr 21, 2026Xiangchen Wang, Weiye Zhu, Teng Wang +5Vision-Language NavigationAction Chunking

  20. The Essence of Balance for Self-Improving Agents in Vision-and-Language Navigation

    Apr 21, 2026Zhen Liu, Yuhan Liu, Jinjun Wang +3Vision-Language NavigationSelf-Improving Agents

  21. Instruction-as-State: Environment-Guided and State-Conditioned Semantic Understanding for Embodied Navigation

    Apr 20, 2026Zhen Liu, Yuhan Liu, Jinjun Wang +3Embodied NavigationVision-Language Navigation

  22. Dual-Anchoring: Addressing State Drift in Vision-Language Navigation

    Apr 19, 2026Kangyi Wu, Pengna Li, Kailin Lyu +5VLM AdaptationVision-Language Navigation

  23. LookasideVLN: Direction-Aware Aerial Vision-and-Language Navigation

    Apr 19, 2026Yuwei Ning, Ganlong Zhao, Yipeng Qin +4Vision-Language NavigationAerial VLN

  24. Rule-VLN: Bridging Perception and Compliance via Semantic Reasoning and Geometric Rectification

    Apr 18, 2026Jiawen Wen, Penglei Sun, Wenjie Zhang +4Safe Robot NavigationVision-Language Navigation

  25. FineCog-Nav: Integrating Fine-grained Cognitive Modules for Zero-shot Multimodal UAV Navigation

    Apr 17, 2026Dian Shao, Zhengzheng Xu, Peiyang Wang +4Zero-Shot LearningUAV Navigation

  26. Language-Conditioned World Modeling for Visual Navigation

    Mar 23, 2026Yifei Dong, Fengyi Wu, Yilong Dai +8World Model LearningVision-Language Navigation

  27. SpatialFly: Implicit 3D Prior-Guided Visual Reparameterization for Continuous UAV Vision-and-Language Navigation

    Mar 22, 2026Wen Jiang, Kangyao Huang, Li Wang +9Visual Representation Learning3D Spatial Reasoning

  28. ImagiNav: Scalable Embodied Navigation via Generative Visual Prediction and Inverse Dynamics

    Mar 14, 2026Jie Chen, Yuxin Cai, Yizhuo Wang +5Robot NavigationVision-Language Navigation

  29. SPAN-Nav: Generalized Spatial Awareness for Versatile Embodied Navigation

    Mar 10, 2026Jiahang Liu, Tianyu Xu, Jiawei Chen +9Embodied NavigationVision-Language Navigation