Efficient VLA Model Inference

VLA: Vision-Language-Action

Latest papers 104

All topics
CardsList
  1. Continue or Replan? Bernoulli-Continuation Policy Learning for Adaptive Horizon Execution

    Aug 4, 2026Weichen Xu, Zhenhua Liu, Lin Luo +8Efficient VLA Model InferenceRobotic Manipulation

  2. WAM-Diff2: Hierarchical AR-to-Diffusion Distillation for Highly Efficient Autonomous Driving VLA

    Aug 2, 2026Zhihao Zhu, Hanlin Shang, Mingwang Xu +6End-to-End Autonomous DrivingDiffusion Model Distillation

  3. The Gate, Not the Cache: Gate Provenance Bounds the Closed-Loop Reliability of Training-Free VLA Token Skipping

    Aug 1, 2026Qi Luo, Shuaijun Liu, Hao Zhao +5Efficient VLA Model InferenceVision-Language-Action Models

  4. Action Chunk Scheduling for Batched Robot Policy Serving

    Jul 31, 2026Rohan Bansal, David He, Nadun Ranawaka Arachchige +4Multi-Robot SystemsRobot Foundation Models

  5. FibVLA: An Efficient Temporal Vision-Language-Action Model with Fibonacci Sampling

    Jul 31, 2026Li Lin, Wujun Xu, Weiwei Meng +3Efficient VLA Model InferenceEfficient VLA Models

  6. TurboVLA: Real-Time Vision-Language-Action Model at 32 Hz on an RTX 4090 with <1 GB VRAM

    Jul 29, 2026Hengyi Xie, Chenfei Yao, Xianjin Wu +4Efficient VLA Model InferenceEfficient VLA Models

  7. Enfold: Folding World Model Imagination into Predictive Representations for Ultra-Efficient Embodied Control

    Jul 29, 2026Weili Zeng, Yitong Xing, Fulong Liu +10World ModelsEfficient VLA Model Inference

  8. A Motion-Aware Vector Quantization Framework with Centroid Reuse for Efficient VLA Inference

    Jul 27, 2026Zhuoran Song, Haozhe Jiang, Chunyu Qi +4AI Accelerator InferenceEfficient VLA Model Inference

  9. JoyNexus: Service-Oriented Multi-Tenant Post-Training for VLA Models

    Jul 17, 2026Haoran Sun, Wentao Zhang, Junyang Hua +18Efficient VLA Model InferenceVision-Language-Action Models

  10. Think at 5 Hz, Act at 20 Hz: Asynchronous Fast-Slow Vision-Language-Action Inference for Closed-Loop Driving

    Jul 17, 2026Yun Li, Jiachen Gong, Simon Thompson +7Efficient VLA Model InferenceVision-Language-Action Models

  11. Reflex: Real-Time VLA Control through Streaming Inference

    Jul 16, 2026Yuanchun Guo, Bingyan LiuFlow MatchingKV Caching

  12. Jetson-PI: Towards Onboard Real-Time Robot Control via Foresight-Aligned Asynchronous Inference

    Jul 14, 2026Zebin Yang, Qi Wang, Yunhe Wang +6Efficient VLA Model InferenceVision-Language-Action Models

  13. Reducing Temporal Redundancy for Efficient Vision-Language-Action Inference

    Jul 14, 2026Yuzhou Wu, Yuxin Zheng, Muchun Niu +6Efficient VLA Model InferenceEfficient VLA Models

  14. Embodied.cpp: A Portable Inference Runtime of Embodied AI Models on Heterogeneous Robots

    Jul 2, 2026Ling Xu, Chuyu Han, Borui Li +6Efficient Neural Network InferenceEfficient VLA Model Inference

  15. Action ControlNet: A Lightweight Delay-Aware Adapter for Smooth Asynchronous Control in Vision-Language-Action Models

    Jun 24, 2026Tiecheng Guo, Meng GuoRobotic ControlLanguage-Conditioned Robot Manipulation

  16. UniFS: Unified Fast-to-Slow Hierarchical Architecture for Vision-Language-Action Models

    Jun 22, 2026Lin Sun, Zhiwei Guan, Conglin Wang +7Efficient VLM InferenceEfficient VLA Model Inference

  17. Finetuning Vision-Language-Action Models Requires Fewer Layers Than You Think

    Jun 18, 2026Gia-Binh Nguyen, Trong-Bao Ho, Thien-Loc Ha +18Model CompressionEfficient VLA Model Inference

  18. Mix-QVLA: Task-Evidence-Aware Mixed-Precision Quantization of Vision-Language-Action Models

    Jun 17, 2026Navin Ranjan, Andreas SavakisMixed-Precision QuantizationVLM Quantization

  19. vla.cpp: A Unified Inference Runtime for Vision-Language-Action Models

    Jun 6, 2026Khanh D. Nguyen, Hung T. Ho, Chinh T. Nguyen +5AI Accelerator InferenceEfficient VLM Inference

  20. TBD-VLA: Temporal Block Diffusion Vision Language Action Model

    Jun 5, 2026Sung-Wook Lee, Xuhui Kang, Yen-Ling KuoEfficient VLA Model InferenceEfficient VLA Models

  21. RhinoVLA Technical Report

    Jun 5, 2026Huixi Technology, :, Chen Zhang +13Efficient VLM InferenceEfficient VLA Model Inference

  22. Threading Optimization for Vision-Language-Action Model Inference in Low-Cost Smart Agricultural Manipulation

    May 31, 2026Keith Truongcao, Christopher Nhu, Zijian An +3Efficient VLA Model InferenceRobotic Manipulation

  23. VisualThink-VLA: Visual Intermediate Reasoning for Effective and Low-Latency Vision-Language-Action Policies

    May 28, 2026Mingjian Gao, Wenqiao Zhang, Yuqian Yuan +9Efficient VLM InferenceEfficient VLA Model Inference

  24. ElegantVLA: Learning When to Think for Efficient Vision-Language-Action Models

    May 28, 2026Ye Li, Huanan Liu, Kangye Ji +7Efficient VLM InferenceEfficient VLA Model Inference

  25. Ω-QVLA: Robust Quantization for Vision-Language-Action Models via Composite Rotation and Per-step Scaling

    May 27, 2026Xinyu Wang, Mingze Li, Sicheng Lyu +6VLM QuantizationEfficient VLA Model Inference