VLM Quantization

VLM: Vision-Language Model

Momentum

11 papers in the last four weeks, with none the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 32

All topics
CardsList
  1. ActTune: Action-Aware Precision and GPU Operating-Point Adaptation for Energy-Efficient Vision-Language-Action Inference

    Oct 6, 2026Zou Qingyun, Bin Gao, Wenju Zhao +3Energy-Efficient MLVLM Quantization

  2. Beyond In-Distribution Preservation: Recovering Generalization in Quantized VLAs via Vulnerability-Oriented Tuning

    Oct 5, 2026Shen Ruan, Wenchang Gao, Jin Wang +4VLM QuantizationOOD Generalization

  3. Calibrate the Decisions That Change the Future: On-Policy Post-Training Quantization for Multimodal Large Language Models

    Sep 29, 2026Wenxiao Fan, Jingling Fu, Lichen Ma +6LLM QuantizationVLM Quantization

  4. EdgeVLN: Runtime-Aware Deployment Ready Quantized Vision Language Navigation Model

    Sep 28, 2026Rithvik Jonna, Man Namgung, Aakash Gurram +1Visual NavigationVLM Quantization

  5. SubRot: Signed Gradient Subspace Calibration for VLM Rotation Quantization

    Sep 28, 2026Zhenhao Shang, Haizhao Jing, Haokui Zhang +4VLM QuantizationRotation-Based Quantization

  6. P4Q: Co-designing Token Pruning and Quantization for Vision-Language Model Acceleration

    Sep 28, 2026Haizhao Jing, Zhenhao Shang, Haokui Zhang +2VLM QuantizationEfficient VLM Inference

  7. Beyond Reconstruction Loss in Post-Training Quantization: Balanced Fitting for Large Vision-Language Models

    Sep 28, 2026Minchan Kang, Kyeonghye Park, Seungyeon Sa +3VLM QuantizationLarge Vision-Language Models

  8. GHOST-Q: Towards Studying Grounding Hallucinations Overlooked Under Same-score TradeOffs in Quantized VLMS

    Sep 24, 2026Saim Rehman, Muhammad ShafiqueVLM EvaluationVLM Quantization

  9. RGSQ: Riemannian Geometry-Sensitive Quantization for Large Vision-Language Models

    Sep 21, 2026Zhiping Wu, Dongdong Ren, Yangchengyu Zhou +4VLM QuantizationLarge Vision-Language Models

  10. SPHQuant: Efficient extreme low bit weight quantization for Vision-Language Models

    Sep 21, 2026Kewei Zhang, Zheng Chen, Haotong Qin +1VLM QuantizationEfficient VLM Inference

  11. FoldQuantVLA: Native Low-Bit Quantization of Vision-Language-Action Models via Consistent Folding

    Sep 21, 2026Hung T. Ho, Khanh D. Nguyen, Quang D. Nguyen +5VLM QuantizationEfficient VLA Model Inference

  12. MiX: Micro-Inverted-Scaling for End-to-End Low-Bit Vision-Language Model Acceleration

    Sep 17, 2026Yuan Liao, Jae-sun SeoAI Accelerator InferenceVLM Quantization

  13. Efficient Quantization-Aware Distillation with Cross-Modal Alignment for Edge Vision-Language Models

    Sep 15, 2026Jinwoo Jeon, GyuYeop Do, Yubin Lim +4VLM QuantizationEfficient VLM Inference

  14. C-PTQ: Fisher-weighted Channel-wise Sensitivity for Post-training Quantization of MLLMs

    Jul 23, 2026Jiameng Li, Han Zhou, Matthew B. BlaschkoVLM QuantizationPost-Training Quantization

  15. Beyond Independent Optimization: Compression, MoE Routing, and Quantization Interactions in Multimodal Edge Intelligence

    Jul 23, 2026Jay Gor, Karm Dave, Akshita Abrol +3Efficient Multimodal InferenceVLM Quantization

  16. SAB-LVLM: Significance-Aware Binarization for Large Vision-Language Models

    Jul 2, 2026Qi Lyu, Jiahua Dong, Baichen Liu +7Model CompressionVision-Language Models

  17. Mix-QVLA: Task-Evidence-Aware Mixed-Precision Quantization of Vision-Language-Action Models

    Jun 17, 2026Navin Ranjan, Andreas SavakisMixed-Precision QuantizationVLM Quantization

  18. MODE: Modality-Decomposed Expert-Level Mixed-Precision Quantization for MoE Multimodal LLMs

    Jun 15, 2026Yuanteng Chen, Peisong Wang, Zhilei Liu +9Mixed-Precision QuantizationLLM Quantization

  19. Ω-QVLA: Robust Quantization for Vision-Language-Action Models via Composite Rotation and Per-step Scaling

    May 27, 2026Xinyu Wang, Mingze Li, Sicheng Lyu +6VLM QuantizationEfficient VLA Model Inference

  20. The Rescue Effect: Spatio-Semantic Early Exit Bypasses Quantization Collapse in CLIP

    May 26, 2026Kahyeon Nam, Hyesong ChoiVLM QuantizationActivation Quantization

  21. ActQuant: Sub-4-bit Action-Guided Quantization for Vision-Language-Action Models

    May 19, 2026Arash Akbari, Arman Akbari, Masih Eskandar +11Mixed-Precision QuantizationVLM Quantization

  22. Breaking Modality Heterogeneity in Low-Bit Quantization for Large Vision-Language Models

    May 19, 2026Yi Zhong, Haotong Qin, Xindong Zhang +2Vision-Language ModelsVLM Quantization

  23. WindowQuant: Mixed-Precision KV Cache Quantization based on Window-Level Similarity for VLMs Inference Optimization

    May 4, 2026Wei Tao, Xiaoyang Qu, Peiqiang Wang +4Mixed-Precision QuantizationVLM Quantization

  24. Towards Joint Quantization and Token Pruning of Vision-Language Models

    Apr 19, 2026Xinqing Li, Xin He, Xindong Zhang +3Vision-Language ModelsVLM Quantization

  25. DyQ-VLA: Temporal-Dynamic-Aware Quantization for Embodied Vision-Language-Action Models

    Mar 9, 2026Zihao Zheng, Hangyu Cao, Chibang Tao +9VLM QuantizationEfficient VLA Model Inference

  26. Gated Relational Alignment via Confidence-based Distillation for Efficient VLMs

    Jan 30, 2026Yanlong Chen, Amirhossein Habibian, Luca Benini +1Cross-Modal Knowledge DistillationVision-Language Models