Efficient VLA Models

VLA: Vision-Language-Action

Latest papers 67

All topics
CardsList
  1. eRLT: Efficient VLA Reinforcement Learning via Action-Relevant Token Routing

    Oct 1, 2026Dehao Huang, Jianbang Liu, Jianpan Gao +7Efficient VLA ModelsRobotic Manipulation

  2. ActionUNet: Improving Robustness of VLA Models with Efficient Multi-scale Fine-tuning

    Sep 28, 2026Di Zhu, Ziheng Yan, Fang WanRobotic ControlEfficient VLA Models

  3. Adjoint Guidance Flow: Amortized Critic Guidance for VLA Policies

    Sep 28, 2026Jeongsol Kim, Youngjun Jun, Kyumin Choi +6Efficient VLA ModelsVision-Language-Action Models

  4. FailPatch: Failure Residual Patching for Vision-Language-Action Models

    Sep 28, 2026Peng Yu, Jiacheng Wang, Ziheng Zhang +6Robot Policy LearningRobot Policy Adaptation

  5. SLIP-VLA: Single-Step Latent Imagination for Policy Learning in Vision-Language-Action Models

    Sep 27, 2026Tianfu Li, Haoxuan Xu, Wenbo Chen +7World Model LearningVisuomotor Policy Learning

  6. FRAM: Trajectory-Guided Visual Feature Selection for Compact Language-Conditioned Robot Manipulation

    Sep 25, 2026Hiroshi Ito, Hyogo Hiruma, Yoshiki Kanai +3Language-Conditioned Robot ManipulationEfficient VLA Models

  7. Recovering Aggressively Pruned Vision-Language-Action Models with Offline Hidden-State Distillation

    Sep 17, 2026Chiyoung Kim, Sanghyuk Roy Choi, Minhyeok LeeEfficient VLA ModelsVision-Language-Action Models

  8. FIVE-VLA: Fast and EffectIVE Autonomous Driving with Recurrent Action Memory

    Sep 16, 2026Kemal Oksuz, Alexandru Buburuzan, Yuhan Yao +1Memory-Augmented VLMsVLMs for Autonomous Driving

  9. Decoupling Vision, Language, and Action for Efficient Multi-Task Robot Policies

    Sep 16, 2026Xiatao Sun, Chen Liang, Ziyao Zeng +5Visuomotor Policy LearningEfficient VLA Models

  10. Dense to MoE Adaptation for Compact Vision Language Action Policies

    Sep 15, 2026Muchun Niu, Shuang Chen, Yuzhou Wu +1Robot Policy AdaptationEfficient VLA Models

  11. What Makes an Efficient VLA? Navigating Action-Head Design, Scaling, and Latency

    Sep 12, 2026Luoyang Sun, Guoyang Xia, Fengfa Li +9Efficient VLA ModelsRobotic Manipulation

  12. ComVLA: Communication-Aware Split Inference for VLA Models in 6G-Connected Robotics

    Sep 7, 2026Boliang Liu, Wint Yi Poe, Jingyun Di +2Efficient VLA Model InferenceEfficient VLA Models

  13. WISE: World-model-guided Imagination Scheduling for Efficient Post-training of Vision-Language-Action Models

    Sep 3, 2026Chenhao Zhang, Hanyu Zhao, Hang Cheng +2Robot Skill LearningWorld Models for Robotics

  14. DriftingVLA: Native One-Step Vision-Language-Action Generation via Per-Dimension Temporal Drifting

    Aug 30, 2026Yuxuan Gao, Shiqi Zhang, Yedong Shen +6Efficient VLA Model InferenceVisuomotor Policy Learning

  15. LM-X: Explainable Vision--Language--Action Modeling via Progress, Event, and Uncertainty Prediction

    Aug 26, 2026Jin Lou, Zhiyuan Jing, Xupeng Wang +21Robotic ControlUncertainty Estimation for VLA Models

  16. Neural Introspection Gating for Adaptive KV-Cache Reuse in Vision-Language-Action Models

    Aug 11, 2026Zhijie Wu, Kento Kawaharazuka, Kei OkadaAdaptive InferenceKV Caching

  17. World Tokens: Enhancing Embodied Policies with Training-Time World Modeling

    Aug 10, 2026Qu Tang, Benhui Zhuang, Bo Yuan +3Efficient VLA Model InferenceEfficient VLA Models

  18. Unified Visuomotor Targets: Supervising VLAs Beyond Physical Actions

    Aug 4, 2026Zhenyang Feng, Unnat JainLatent Action LearningVisuomotor Policy Learning

  19. FibVLA: An Efficient Temporal Vision-Language-Action Model with Fibonacci Sampling

    Jul 31, 2026Li Lin, Wujun Xu, Weiwei Meng +3Efficient VLA Model InferenceEfficient VLA Models

  20. TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM

    Jul 29, 2026Hengyi Xie, Chenfei Yao, Xianjin Wu +4Efficient VLA Model InferenceEfficient VLA Models

  21. MemVLN: Episodic and Procedural Memory for Vision-and-Language Navigation

    Jul 26, 2026Yuqi Liu, Shengju Qian, Tianyuan Qu +5Memory-Augmented VLMsEfficient VLM Inference

  22. Hy-Embodied-VLM-1.0: Efficient Physical-World Agents

    Jul 14, 2026Ziyi Wang, Xumin Yu, Yongming Rao +19Efficient VLA ModelsMultimodal Foundation Models

  23. Reducing Temporal Redundancy for Efficient Vision-Language-Action Inference

    Jul 14, 2026Yuzhou Wu, Yuxin Zheng, Muchun Niu +6Efficient VLA Model InferenceEfficient VLA Models

  24. FabriVLA: A Lightweight Vision-Language-Action Model for Precise Multi-Task Manipulation

    Jul 9, 2026Shiyuan Yang, Borong Zhang, Jizheng Zhang +5Efficient VLA ModelsRobotic Manipulation

  25. NativeMEM: Native Memory Compression for Long-Horizon Robotic Manipulation

    Jul 7, 2026Ziye Wang, Modi Shi, Chaojun Ni +5Memory-Augmented VLMsLong-Horizon Robotic Manipulation

  26. XS-VLA: Teaching Tiny Vision-Language-Action Models with Spatial Supervision and Demonstration Conditioning

    Jul 5, 2026Iok Tong Lei, Ying Jie Yap, Wei Huang +5Robot Policy LearningLanguage-Conditioned Robot Manipulation

  27. Learning to Move Before Learning to Do: Task-Agnostic pretraining for VLAs

    Jul 2, 2026Junhao Shi, Siyin Wang, Xiaopeng Yu +3Self-Supervised Pre-TrainingEfficient VLA Models