VLM Distillation

VLM: Vision-Language Model

Latest papers 78

All topics
CardsList
  1. A General-Purpose VLM Can Teach an Astronomy Foundation Model to Better Recognize Galaxy Morphology

    Aug 3, 2026Dichang Zhang, Jiaqi Deng, Yixuan Shao +7VLM EvaluationAI-Assisted Scientific Research

  2. Distill What the Student Can See: Fisher-Projected On-Policy Distillation for Vision-Language Models

    Aug 2, 2026Leyan Xue, Feng Xiong, Mingjun Ma +1VLM DistillationOn-Policy Distillation

  3. Distill What RGB Can Recover: Privileged 3D Evidence for RGB-Only Vision-Language Models

    Jul 31, 2026Yanbin Hu, Jin Cui, Jun Ye +43D Spatial ReasoningVLM Distillation

  4. Outcome-Guided Distillation: A Teacher-Student Framework to Advance VLM Reasoning in Autonomous Driving

    Jul 31, 2026Zeyu Dong, Yimin Zhu, Yu Wu +1VLMs for Autonomous DrivingEnd-to-End Autonomous Driving

  5. VAD: Attributing Visual Evidence for Target Reconstruction in Multimodal On-Policy Distillation

    Jul 30, 2026Kangning Zhang, Yixing Li, Shuai Shao +9Feature AttributionVLM Distillation

  6. Veritas++: Value-aware On-Policy Distillation for Perception-Enhanced AIGI Detection

    Jul 29, 2026Hao Tan, Jun Lan, Zichang Tan +7VLM DistillationLarge Vision-Language Models

  7. Self-Boosting Vision-Language Models with Noisy Student On-Policy Self-Distillation

    Jul 25, 2026Shuai Wang, Daoan Zhang, Zhe Tang +2VLM AdaptationOn-Policy Self-Distillation

  8. Visual Saliency Steering Distillation for Multimodal Chain-of-Thought Reasoning

    Jul 24, 2026Hao Yang, Jin Wang, Xuejie ZhangVLM DistillationMultimodal QA

  9. Visual Contrastive Self-Distillation

    Jul 23, 2026Yijun Liang, Yunjie Tian, Yijiang Li +4On-Policy Self-DistillationVLM Distillation

  10. SOPD-SocialNav: Selective On-Policy Distillation for Vision-Language Social Navigation

    Jul 22, 2026Xinyu Zhang, Zishuo Wang, Ling XiaoEfficient VLM InferenceVLM Distillation

  11. MOPDA: Mixed-Trajectory On-Policy Distillation for Language-Guided Industrial Anomaly Detection

    Jul 21, 2026Shuimu Chen, Jing Jin, Nan Su +5Industrial Anomaly DetectionVLM Distillation

  12. CritiqueDriveVLM: From Verifier-Guided Reinforcement Learning to Latent Thought Distillation for Autonomous Driving

    Jul 5, 2026Zhaohong Liu, Hao Ye, Xianlin Zhang +1VLMs for Autonomous DrivingEfficient VLM Inference

  13. Teaching Vision-Language-Action Models What to See and Where to Look

    Jul 2, 2026Yuguang Yang, Canyu Chen, Zhewen Tan +10End-to-End Autonomous DrivingVLM Distillation

  14. Token-level Response-visual Attention Guidance for Multimodal LLMs Knowledge Distillation

    Jul 1, 2026Jaehyun Jang, Eunseop Yoon, Hee Suk Yoon +3Cross-Modal Knowledge DistillationVLM Distillation

  15. H-OPD: Confidence Aware Heterogeneous Multi-Teacher Multimodal On-policy Distillation

    Jul 1, 2026Qixiang Yin, Huanjin Yao, Yuchen Cai +5Cross-Modal Knowledge DistillationVLM Distillation

  16. DOPD: Dual On-policy Distillation

    Jun 29, 2026Xinlei Yu, Gen Li, Qingyi Si +13On-Policy Self-DistillationVLM Distillation

  17. LocalNav: Distilling Frontier VLMs and Embodied RL for On-Device Object Goal Navigation

    Jun 26, 2026Nicolas Baumann, Liam Boyle, Pu Deng +5Efficient VLM InferenceVLM Distillation

  18. V-Zero: Answer-Label-Free On-Policy Distillation with Contrastive Evidence Gating for Fine-Grained Visual Reasoning

    Jun 24, 2026Haoxiang Sun, Zhihang Yi, Langxuan Deng +6Visual ReasoningVLM Distillation

  19. The Professor: Multi-Teacher Unsupervised Prompt Distillation for Vision-Language Models

    Jun 22, 2026Ahmad Algadhi, Ahmed Alzuhair, Omar Alkhulaif +1VLM DistillationMulti-Teacher Knowledge Distillation

  20. LEViL: Label-Efficient Video Learning via Zero-Shot Distillation over VLM-Generated Pseudo-Label Spaces

    Jun 19, 2026Aslı ÇelikVLM DistillationVideo Action Recognition

  21. Guava: Distilling Frontier VLMs into a Compact Agent through a Robotic Manipulation Harness

    Jun 16, 2026Haowen Liu, Xirui Li, Shaoxiong Yao +5Long-Horizon Robotic ManipulationVLM Distillation

  22. Trust the Right Teacher: Quality-Aware Self-Distillation for GUI Grounding

    Jun 16, 2026Jingyuan Huang, Zuming Huang, Yucheng Shi +4On-Policy Self-DistillationGUI Grounding

  23. VL2Spike: Spike-driven Distillation from VLMs for Low-Power Visual Perception in Embodied AI

    Jun 14, 2026Zinan Liu, Eric Zheng, Soumyaratna Debnath +3Cross-Modal Knowledge DistillationSpiking Transformers

  24. VISA: VLM-Guided Instance Semantic Auditing for 3D Occupancy World Models

    Jun 11, 2026Ruiqi Xian, Yuehan Xian, Jing Liang +2Cross-Modal Knowledge DistillationWorld Model Learning

  25. ViCuR: Visual Cues as Recoverable Privilege for Multimodal On-Policy Distillation

    Jun 4, 2026Kanghui Tian, Siyuan Liu, Ziang Yan +3VLM DistillationMultimodal Reasoning

  26. Geometry-Aware Distillation for Prompt Tuning Biomedical Vision-Language Models

    Jun 3, 2026Tran Dinh Tien, Zhiqiang ShenVLM AdaptationVLM Distillation