Reasoning for VLA Models

VLA: Vision-Language-Action

Latest papers 54

All topics
CardsList
  1. Explicit Geometric Chain-of-Thought for Vision-Language-Action in Autonomous Driving

    Oct 7, 2026Xingtai Gui, Yucheng Zhou, Dongqian Guo +3Autonomous Driving PlanningReasoning for VLA Models

  2. What Makes World Action Models Generalize? An Empirical Study of Test-Time Future Modeling

    Sep 28, 2026Renping Zhou, Zanlin Ni, Zihao Fan +8Action-Conditioned World ModelsEfficient VLA Model Inference

  3. GroundingVLN: Reasoning and Acting with Grounding for Vision-Language Navigation

    Sep 16, 2026Kailing Li, Yu Han, Tianwen Qian +4Vision-Language NavigationVision-Language Grounding

  4. Decoding Task Progress from VLA Representations

    Aug 13, 2026Atiksh Bhardwaj, Edward Weiyi Duan, Prithwish Dan +2Vision-Language-Action ModelsReasoning for VLA Models

  5. Depth-Wise Probing and Pruning of the Planning Token in a Driving Vision-Language-Action Model

    Aug 7, 2026Harisankar Babu, Benjamin Coors, Christopher Lang +3VLMs for Autonomous DrivingEfficient VLA Model Inference

  6. AtlasVLA: Persistent World-Ego State Modeling for Vision-Language-Action Models

    Aug 7, 2026Guiyu Zhao, Longteng Guo, Yanghong Mei +7Long-Horizon Robotic ManipulationVision-Language-Action Models

  7. In-Context VLA: Endowing Vision-Language-Action Models with Language via In-Context Post-Training and Agentic Tool Use

    Aug 6, 2026Jiarui Yang, Wen Huang, Jiale Zhang +2ICL for RoboticsContinual Learning for VLA Models

  8. ReflectVLN: Training Vision-Language Navigation Agents with Reflective Reasoning

    Jul 14, 2026Jiahang Wang, Yirong Yang, Yanqing Zhu +4Hierarchical PlanningVision-Language Navigation

  9. See like a Robot: Robot-Centric Pointmaps for VLA Models

    Jul 13, 2026Byungkun Lee, Dongyoon Hwang, Dongjin Kim +4Visuomotor Policy LearningRobotic Manipulation

  10. LEEVLA: Seeing What Matters in Latent Environment Evolution for Vision-Language-Action

    Jul 9, 2026Qi Lyu, Baicheng Liu, Xudong Wang +3Latent Dynamics ModelingVision-Language-Action Models

  11. Dual Latent Memory in Vision-Language-Action Models for Robotic Manipulation

    Jul 8, 2026Hongyu Qu, Jianzhe Gao, Xiaobin Hu +6Memory-Augmented VLMsRobotic Manipulation

  12. Do Vision-Language-Action Models Mean What They Say? On the Role of Faithfulness in Embodied Reasoning

    Jul 6, 2026Matthew Foutter, Matteo Cercola, Lena Wild +4VLMs for Autonomous DrivingVision-Language-Action Models

  13. Look Before You Leap: Distilling Tree Search into Action Evaluation for Frozen VLA Models

    Jul 4, 2026Xinyi Xie, Zican Hu, Zhanyu Liu +7Value Function EstimationTest-Time Scaling

  14. Reasoning-aware Speculative Decoding for Efficient Vision-Language-Action Models in Autonomous Driving

    Jun 30, 2026Anh Dung Dinh, Simon Khan, Flora SalimEfficient VLM InferenceSpeculative Decoding

  15. Position: Vision-Language-Action Models Cannot Be Verified to Perform Physical Reasoning

    Jun 28, 2026Taozhao Chen, Ian Manchester, Huaming ChenVLM EvaluationPhysical Reasoning

  16. TAP-VLA: Tactile Annotation Prompting for Vision Language Action Models

    Jun 27, 2026Mark Van der Merwe, Mohamad Louai Shehab, Jayjun Lee +4Vision-Language-Action ModelsTactile Sensing for Robotic Manipulation