Efficient VLA Model Inference

VLA: Vision-Language-Action

Latest papers 104

All topics
CardsList
  1. Decoupled Early Exits for Task-Dependent Compute Allocation in Flow-Matching VLAs

    Sep 24, 2026Riccardo Andrea Izzo, Rimvydas Rubavicius, Gianluca Bardaro +3Efficient VLA Model InferenceVision-Language-Action Models

  2. CereVLA: Cerebellum-Inspired Consequence-Aware Residual Governance for Efficient Vision-Language-Action Execution

    Sep 23, 2026Shuai Zeng, Yuxuan Liang, Hangmiao Hu +4Efficient VLA Model InferenceVision-Language-Action Models

  3. VLAQuantBench: Closed-Loop Evaluation of Post-Training Quantization for Vision-Language-Action Models

    Sep 21, 2026Jiuyi Xu, Qing Jin, Meida Chen +3Mixed-Precision QuantizationEfficient VLA Model Inference

  4. FoldQuantVLA: Native Low-Bit Quantization of Vision-Language-Action Models via Consistent Folding

    Sep 21, 2026Hung T. Ho, Khanh D. Nguyen, Quang D. Nguyen +5VLM QuantizationEfficient VLA Model Inference

  5. vla.simd: Efficient CPU Inference for Language-Conditioned Manipulation

    Sep 21, 2026Khanh D. Nguyen, Hoang M. Truong, An T. LeLanguage-Conditioned Robot ManipulationEfficient VLA Model Inference

  6. SkipVLA: Skipping VLA Steps with Classical Planning for Fast Robot Manipulation

    Sep 17, 2026Kaivalya Agrawal, Md Ashiqur Rahman, Raymond A. Yeh +1Long-Horizon Robotic ManipulationEfficient VLA Model Inference

  7. FASA: Feedback-Aware Sampling Adaptation for Efficient Diffusion-Based VLA Models

    Sep 16, 2026Yuchen Han, Jianhan Wu, Xiaoyang Qu +3Diffusion SamplingEfficient VLA Model Inference

  8. rMuscle: Robotic Muscle Memory for Efficient Vision-Language-Action Model Inference

    Sep 16, 2026Kaijun Zhou, Zhiyang Li, Le Chen +1Efficient VLA Model InferenceVision-Language-Action Models

  9. VLA-ULAP: Interleaving Cloud VLA Calls with Ultra-Lightweight Local Action Prediction at the Edge

    Sep 16, 2026Deyu Cao, Ryuji Oi, Kosuke Matsushima +4Efficient VLA Model InferenceVision-Language-Action Models

  10. Technical Report: One-Step Drifting Action Heads for GR00T N1.7

    Sep 16, 2026Xihe ShaoEfficient VLA Model InferenceVision-Language-Action Models

  11. Efficient Vision-Language-Action Management and Serving for Robot Factories

    Sep 14, 2026Dionysios Adamopoulos, Nattapol Chanpaisit, Basel Fakhri +1Edge ComputingEfficient VLA Model Inference

  12. IMLE-VLA: Fast Single-Step Action Generation for Vision-Language-Action Policies

    Sep 11, 2026Kian Hosseinkhani (Simon Fraser University), Qinhe Peng (University of Pennsylvania), George Shramko (Simon Fraser University) +7Efficient VLA Model InferenceVision-Language-Action Models

  13. ComVLA: Communication-Aware Split Inference for VLA Models in 6G-Connected Robotics

    Sep 7, 2026Boliang Liu, Wint Yi Poe, Jingyun Di +2Efficient VLA Model InferenceEfficient VLA Models

  14. Continuous Actions from Discrete Minds: Latent-Aligned Planning for End-to-End Autonomous Driving

    Sep 3, 2026Ruoyu Yao, Yusen Xie, Qingzhao Liu +5Latent Action LearningEnd-to-End Autonomous Driving

  15. Rethinking Language's Role in Efficient VLA for Autonomous Vehicles: Toward Smarter, Trustworthy Driving

    Aug 31, 2026Tongfei Guo, Lili SuVLMs for Autonomous DrivingEfficient VLA Model Inference

  16. DriftingVLA: Native One-Step Vision-Language-Action Generation via Per-Dimension Temporal Drifting

    Aug 30, 2026Yuxuan Gao, Shiqi Zhang, Yedong Shen +6Efficient VLA Model InferenceVisuomotor Policy Learning

  17. FlashDrive: Flash Vision-Language-Action Inference for Autonomous Driving

    Aug 13, 2026Zekai Li, Yihao Liang, Hongfei Zhang +3Efficient VLA Model InferenceAutonomous Driving

  18. Neural Introspection Gating for Adaptive KV-Cache Reuse in Vision-Language-Action Models

    Aug 11, 2026Zhijie Wu, Kento Kawaharazuka, Kei OkadaAdaptive InferenceKV Caching

  19. World Tokens: Enhancing Embodied Policies with Training-Time World Modeling

    Aug 10, 2026Qu Tang, Benhui Zhuang, Bo Yuan +3Efficient VLA Model InferenceEfficient VLA Models

  20. Depth-Wise Probing and Pruning of the Planning Token in a Driving Vision-Language-Action Model

    Aug 7, 2026Harisankar Babu, Benjamin Coors, Christopher Lang +3VLMs for Autonomous DrivingEfficient VLA Model Inference

  21. Fast and Accurate: An Adaptive VLA Inference Framework through Environment-aware Model Selection

    Aug 6, 2026Yuewei Sun, Lang Qin, Zechuan Tian +11Efficient VLA Model InferenceVLMs for Robotics

  22. Deltoris: Enabling Real-time VLA Inference in Embodied AI via Bit-level Sparsity and Speculative Inference

    Aug 5, 2026Zheng Liu, Zeyu Guo, Zihan Liu +9AI Accelerator InferenceEfficient VLA Model Inference

  23. Faster-WAM: Efficient Inference-Time Future Conditioning for Robust World Action Models

    Aug 5, 2026Weiheng Zhao, Haoyi Jiang, Xin Shi +5Action-Conditioned World ModelsEfficient VLA Model Inference

  24. PhyAI: Real-Time Physical AI at the Edge, Scalable Rollouts in the Cloud

    Aug 4, 2026Chenghua Wang, Daliang Xu, Dongqi Cai +21Efficient VLA Model InferenceOn-Device Inference