Reasoning for VLA Models

VLA: Vision-Language-Action

Latest papers 54

All topics
CardsList
  1. FOCA: Future-Oriented Conditioning for Data-Efficient Vision-Language-Action Adaptation

    Jun 18, 2026Duc Minh Nguyen, Nghiem Tuong Diep, Binh Gia Nguyen +20VLM AdaptationEfficient VLA Models

  2. Tri-Info: Generalizable, Interpretable Failure Prediction for VLA Models via Information Theory

    Jun 18, 2026Jinghan Yang, Yunchao Zhang, Wang Yuan +4Robot Failure DetectionVision-Language-Action Models

  3. ThinkingVLA: Interleaved Vision and Language Reasoning for Robotic Manipulation

    Jun 16, 2026Tianyi Lu, Hui Zhang, Zijie Diao +8Long-Horizon Robotic ManipulationLanguage-Conditioned Robot Manipulation

  4. PearlVLA: Progressive Embodied Action-Plan Refinement in Latent Space

    Jun 16, 2026Bochen Yang, Lianlei ShanEfficient VLA ModelsLatent Visual Reasoning

  5. MPCoT: Reward-Guided Multi-Path Latent Reasoning for Test-Time Scalable Vision-Language-Action

    Jun 4, 2026Boyang Zhang, Lianlei ShanVisuomotor Policy LearningRobotic Manipulation

  6. 3DThinkVLA: Endowing Vision-Language-Action Models with Latent 3D Priors via 3D-Thinking-Guided Co-training

    Jun 3, 2026Jiaxin Shi, Xidong Zhang, Fucai Zhu +33D Spatial ReasoningRobotic Manipulation

  7. SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes

    May 29, 2026Tianhui Liu, Jie Feng, Zhiheng Zheng +6Spatial Reasoning BenchmarksVisual Spatial Reasoning

  8. VisualThink-VLA: Visual Intermediate Reasoning for Effective and Low-Latency Vision-Language-Action Policies

    May 28, 2026Mingjian Gao, Wenqiao Zhang, Yuqian Yuan +9Efficient VLM InferenceEfficient VLA Model Inference

  9. ElegantVLA: Learning When to Think for Efficient Vision-Language-Action Models

    May 28, 2026Ye Li, Huanan Liu, Kangye Ji +7Efficient VLM InferenceEfficient VLA Model Inference

  10. AwareVLN: Reasoning with Self-awareness for Vision-Language Navigation

    May 21, 2026Wenxuan Guo, Xiuwei Xu, Yichen Liu +7Vision-Language NavigationVLM Reasoning

  11. Pelican-Unify 1.0: A Unified Embodied Intelligence Model for Understanding, Reasoning, Imagination and Action

    May 14, 2026Yi Zhang, Yinda Chen, Che Liu +26Action-Conditioned Video GenerationUnified Multimodal Models

  12. Guide, Think, Act: Interactive Embodied Reasoning in Vision-Language-Action Models

    May 13, 2026Yiran Ling, Qing Lian, Jinghang Li +6Robotic ControlRobot Policy Learning

  13. MolmoAct2: Action Reasoning Models for Real-world Deployment

    May 4, 2026Haoquan Fang, Jiafei Duan, Donovan Clay +26RoboticsEfficient VLA Models

  14. Unmasking the Illusion of Embodied Reasoning in Vision-Language-Action Models

    Apr 20, 2026Haiweng Xu, Sipeng Zheng, Hao Luo +3VLM EvaluationVLM Reasoning

  15. ReFineVLA: Multimodal Reasoning-Aware Generalist Robotic Policies via Teacher-Guided Fine-Tuning

    Apr 20, 2026Tuan Van Vo, Tan Q. Nguyen, Khang Nguyen +5Robotic ManipulationVLM Reasoning

  16. World-Value-Action Model: Implicit Planning for Vision-Language-Action Systems

    Apr 16, 2026Runze Li, Hongyin Zhang, Junxi Jin +5Vision-Language-Action ModelsModel-Based Planning

  17. Altered Thoughts, Altered Actions: Reasoning Chain as Control Surface for a Vision-Language-Action Policy

    Mar 13, 2026Tuan Duong Trinh, Basim Azam, Mohammed Ishaq Ansari +2Language-Conditioned Robot ManipulationVision-Language-Action Models