Efficient VLA Model Inference

VLA: Vision-Language-Action

Latest papers 104

All topics
CardsList
  1. REACT: Rolling Denoising and Dual Decoupling for Reactive Robot Control with VLA Models

    Oct 8, 2026Houlong Xiong, Zhenqi Qiu, Zechen Wang +8Robotic ControlVision-Language-Action Models

  2. SpikingVLA: Asynchronous Spiking Vision-Language-Action Models

    Oct 7, 2026Jingya Wang, Dehao Zhang, Shuai Wang +3Efficient VLA Model InferenceSpiking Neural Networks

  3. CARE: Certifying Acceleration for Vision-Language-Action Inference

    Oct 6, 2026Rui Liu, Tong Zheng, Jindong Gu +1Efficient VLA Model InferenceVision-Language-Action Models

  4. ActTune: Action-Aware Precision and GPU Operating-Point Adaptation for Energy-Efficient Vision-Language-Action Inference

    Oct 6, 2026Zou Qingyun, Bin Gao, Wenju Zhao +3Energy-Efficient MLVLM Quantization

  5. StairVLA: Stage-Aware Hierarchical Action Generation for Vision-Language-Action Models

    Oct 6, 2026Shangyuan Yuan, Xinda Qi, Yujiang Pu +2Efficient VLA Model InferenceVision-Language-Action Models

  6. ESP: Energy-Score Policy for One-Step Multimodal Action Generation

    Oct 6, 2026Lilika Makabe, Heecheol Kim, Yasuyuki MatsushitaEfficient VLA Model InferenceVision-Language-Action Models

  7. Imagine the Future, Internalize the Gist: Efficient VLA Reasoning via Internalized Spatiotemporal Imagination

    Oct 2, 2026Shenglan Li, Zhendong Mi, Hengyi Zhu +6VLMs for RoboticsReasoning for VLA Models

  8. Kinematic MeanFlow: One-Step Action Generation Policy for Robotic Foundation Models

    Oct 1, 2026Jiawei Fan, Sifeng Wang, Yuqing Hou +1Flow MatchingRobot Foundation Models

  9. Toward Real-Time VLAs: Stage-Aware Two-Step Flow Denoising and System-Level Evaluation

    Sep 30, 2026Di Wu, Rongtian Shen, Ping Liu +8Robotic ControlFlow Matching

  10. Discrete Forcing: Infusing Discrete Guidance into Continuous Denoising for Few-Step Action Experts

    Sep 30, 2026Jingbo Wang, Wenxuan Song, Wenhao Yu +6Flow MatchingEfficient VLA Model Inference

  11. WayFinder: Hierarchical Visual-Language-Action for Zero-Shot Waypoint Generation and Low-Level Kinematic Control

    Sep 29, 2026Timothy K Johnsen, Marco LevoratoRobotic ControlLarge Language Model-Based Robot Planning

  12. Beyond Token Importance: Preserving Spatial Scaffolds for Efficient Vision-Language-Action Inference

    Sep 29, 2026Jiayu Chen, Shuyong Gao, Jingkai Jia +6Efficient VLA Model InferenceVLMs for Robotics

  13. Reactive Real-Time Flow Policies via Asynchronous Distribution Alignment

    Sep 29, 2026Moritz Zoellner, Reece O'Mahoney, Ioannis Havoutis +1Robot Policy LearningEfficient VLA Model Inference

  14. Staircase Policy: Streaming Inference for World-Action Models with Large Action Chunks

    Sep 29, 2026Guoheng Sun, Chen Chen, Jin Wang +2Long-Horizon Robotic ManipulationAction-Conditioned World Models

  15. EdgeVLN: Runtime-Aware Deployment Ready Quantized Vision Language Navigation Model

    Sep 28, 2026Rithvik Jonna, Man Namgung, Aakash Gurram +1Visual NavigationVLM Quantization

  16. What Makes World Action Models Generalize? An Empirical Study of Test-Time Future Modeling

    Sep 28, 2026Renping Zhou, Zanlin Ni, Zihao Fan +8Action-Conditioned World ModelsEfficient VLA Model Inference

  17. Don't Throw Away the Tail: Action Upcycling for Policy Acceleration

    Sep 28, 2026Taesung Kwon, Jangho Park, Sunwoo Park +5Robot Policy LearningEfficient VLA Model Inference

  18. D2^2-VLA: Dual-Memory Dual-Frequency Vision-Language-Action Model For Long Dynamic Manipulation

    Sep 28, 2026Zijian Ye, Chengqi Wei, Wei Huang +9Memory-Augmented VLMsLong-Horizon Robotic Manipulation

  19. Alignment-Guided Flow Transformer for Efficient Vision-Language-Action Policy Learning

    Sep 28, 2026Shengchao Hu, Peng Wang, Qiyang Zhou +5Efficient VLA Model InferenceVision-Language-Action Models

  20. Text-Vision Synergistic Token Caching: A Training-Free Framework for Efficient Vision-Language-Action Inference

    Sep 28, 2026Qianer Li, Chengjie Zhang, Jingwen Chen +3Efficient VLA Model InferenceVision-Language-Action Models

  21. RAVEL: Asynchronous Rolling Inference for Flow-Based Vision-Language-Action Models

    Sep 28, 2026Yuhan Chen, Ke Yu, Pengfei Liu +3Efficient VLA Model InferenceVision-Language-Action Models

  22. Quantile Head for Vision-Language-Action Models

    Sep 28, 2026Xuan Wang, Yinan Wu, Haoran Duan +1Quantile RegressionEfficient VLA Model Inference