Efficient VLA Models

VLA: Vision-Language-Action

Latest papers 70

All topics
CardsList
  1. Tell Robot What Not to Do: A Negation Understanding Perspective

    Oct 8, 2026Fazeng Li, Gan Sun, Hao Cheng +2Vision-Language-Action ModelsReasoning for VLA Models

  2. NavGPT-3: Harnessing Context in a Hierarchical Navigation Runtime

    Oct 7, 2026Gengze Zhou, Yicong Hong, Jiazhao Zhang +9Robot NavigationVision-Language Navigation

  3. eRLT: Efficient VLA Reinforcement Learning via Action-Relevant Token Routing

    Oct 1, 2026Dehao Huang, Jianbang Liu, Jianpan Gao +7Efficient VLA ModelsRobotic Manipulation

  4. ActionUNet: Improving Robustness of VLA Models with Efficient Multi-scale Fine-tuning

    Sep 28, 2026Di Zhu, Ziheng Yan, Fang WanRobotic ControlEfficient VLA Models

  5. Adjoint Guidance Flow: Amortized Critic Guidance for VLA Policies

    Sep 28, 2026Jeongsol Kim, Youngjun Jun, Kyumin Choi +6Efficient VLA ModelsVision-Language-Action Models

  6. FailPatch: Failure Residual Patching for Vision-Language-Action Models

    Sep 28, 2026Peng Yu, Jiacheng Wang, Ziheng Zhang +6Robot Policy LearningRobot Policy Adaptation

  7. SLIP-VLA: Single-Step Latent Imagination for Policy Learning in Vision-Language-Action Models

    Sep 27, 2026Tianfu Li, Haoxuan Xu, Wenbo Chen +7World Model LearningVisuomotor Policy Learning

  8. FRAM: Trajectory-Guided Visual Feature Selection for Compact Language-Conditioned Robot Manipulation

    Sep 25, 2026Hiroshi Ito, Hyogo Hiruma, Yoshiki Kanai +3Language-Conditioned Robot ManipulationEfficient VLA Models

  9. Recovering Aggressively Pruned Vision-Language-Action Models with Offline Hidden-State Distillation

    Sep 17, 2026Chiyoung Kim, Sanghyuk Roy Choi, Minhyeok LeeEfficient VLA ModelsVision-Language-Action Models

  10. FIVE-VLA: Fast and EffectIVE Autonomous Driving with Recurrent Action Memory

    Sep 16, 2026Kemal Oksuz, Alexandru Buburuzan, Yuhan Yao +1Memory-Augmented VLMsVLMs for Autonomous Driving

  11. Decoupling Vision, Language, and Action for Efficient Multi-Task Robot Policies

    Sep 16, 2026Xiatao Sun, Chen Liang, Ziyao Zeng +5Visuomotor Policy LearningEfficient VLA Models

  12. Dense to MoE Adaptation for Compact Vision Language Action Policies

    Sep 15, 2026Muchun Niu, Shuang Chen, Yuzhou Wu +1Robot Policy AdaptationEfficient VLA Models

  13. What Makes an Efficient VLA? Navigating Action-Head Design, Scaling, and Latency

    Sep 12, 2026Luoyang Sun, Guoyang Xia, Fengfa Li +9Efficient VLA ModelsRobotic Manipulation

  14. ComVLA: Communication-Aware Split Inference for VLA Models in 6G-Connected Robotics

    Sep 7, 2026Boliang Liu, Wint Yi Poe, Jingyun Di +2Efficient VLA Model InferenceEfficient VLA Models

  15. WISE: World-model-guided Imagination Scheduling for Efficient Post-training of Vision-Language-Action Models

    Sep 3, 2026Chenhao Zhang, Hanyu Zhao, Hang Cheng +2Robot Skill LearningWorld Models for Robotics

  16. DriftingVLA: Native One-Step Vision-Language-Action Generation via Per-Dimension Temporal Drifting

    Aug 30, 2026Yuxuan Gao, Shiqi Zhang, Yedong Shen +6Efficient VLA Model InferenceVisuomotor Policy Learning

  17. LM-X: Explainable Vision--Language--Action Modeling via Progress, Event, and Uncertainty Prediction

    Aug 26, 2026Jin Lou, Zhiyuan Jing, Xupeng Wang +21Robotic ControlUncertainty Estimation for VLA Models

  18. Neural Introspection Gating for Adaptive KV-Cache Reuse in Vision-Language-Action Models

    Aug 11, 2026Zhijie Wu, Kento Kawaharazuka, Kei OkadaAdaptive InferenceKV Caching

  19. World Tokens: Enhancing Embodied Policies with Training-Time World Modeling

    Aug 10, 2026Qu Tang, Benhui Zhuang, Bo Yuan +3Efficient VLA Model InferenceEfficient VLA Models

  20. Unified Visuomotor Targets: Supervising VLAs Beyond Physical Actions

    Aug 4, 2026Zhenyang Feng, Unnat JainLatent Action LearningVisuomotor Policy Learning

  21. FibVLA: An Efficient Temporal Vision-Language-Action Model with Fibonacci Sampling

    Jul 31, 2026Li Lin, Wujun Xu, Weiwei Meng +3Efficient VLA Model InferenceEfficient VLA Models

  22. TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM

    Jul 29, 2026Hengyi Xie, Chenfei Yao, Xianjin Wu +4Efficient VLA Model InferenceEfficient VLA Models

  23. MemVLN: Episodic and Procedural Memory for Vision-and-Language Navigation

    Jul 26, 2026Yuqi Liu, Shengju Qian, Tianyuan Qu +5Memory-Augmented VLMsEfficient VLM Inference

  24. Hy-Embodied-VLM-1.0: Efficient Physical-World Agents

    Jul 14, 2026Ziyi Wang, Xumin Yu, Yongming Rao +19Efficient VLA ModelsMultimodal Foundation Models

  25. Reducing Temporal Redundancy for Efficient Vision-Language-Action Inference

    Jul 14, 2026Yuzhou Wu, Yuxin Zheng, Muchun Niu +6Efficient VLA Model InferenceEfficient VLA Models

  26. FabriVLA: A Lightweight Vision-Language-Action Model for Precise Multi-Task Manipulation

    Jul 9, 2026Shiyuan Yang, Borong Zhang, Jizheng Zhang +5Efficient VLA ModelsRobotic Manipulation

  27. NativeMEM: Native Memory Compression for Long-Horizon Robotic Manipulation

    Jul 7, 2026Ziye Wang, Modi Shi, Chaojun Ni +5Memory-Augmented VLMsLong-Horizon Robotic Manipulation