VLM Adaptation

VLM: Vision-Language Model

Latest papers 395

All topics
CardsList
  1. Unlocking Patch-Level Features for CLIP-Based Class-Incremental Learning

    May 13, 2026Hao Sun, Zi-Jun Ding, Da-Wei ZhouClass-Incremental LearningVLM Adaptation

  2. Test-Time Hinting for Black-Box Vision-Language Models

    May 13, 2026Kaihua Hou, Abhijith Varma Mudunuri, Jiaxing Qiu +3Visual Question AnsweringVLM Adaptation

  3. Anomaly-Aware Vision-Language Adapters for Zero-Shot Anomaly Detection

    May 12, 2026Muhammad Aqeel, Maham Nazir, Uzair Khan +2VLM AdaptationMedical Image Anomaly Detection

  4. Cluster-Aware Neural Collapse Prompt Tuning for Long-Tailed Generalization of Vision-Language Models

    May 12, 2026Boyang Guo, Liang Li, Lin Peng +3Long-Tail LearningVLM Adaptation

  5. CapVector: Learning Transferable Capability Vectors in Parametric Space for Vision-Language-Action Models

    May 11, 2026Wenxuan Song, Han Zhao, Fuhao Li +7Task VectorsVLM Adaptation

  6. Learning More from Less: Exploiting Counterfactuals for Data-Efficient Chart Understanding

    May 11, 2026Jianzhu Bao, Haozhen Zhang, Kuicai Dong +5Data VisualizationVLM Adaptation

  7. UniSteer: Unified Noise Steering for Efficient Human-Guided VLA Adaptation

    May 11, 2026Junjie Lu, Xinyao Qin, Yuhua Jiang +6RL for RoboticsRobot Policy Adaptation

  8. Thermal-Det: Language-Guided Cross-Modal Distillation for Open-Vocabulary Thermal Object Detection

    May 11, 2026Yasiru Ranasinghe, Elim Schenck, Florence Yellin +3Open-Vocabulary Object DetectionCross-Modal Knowledge Distillation

  9. Hystar: Hypernetwork-driven Style-adaptive Retrieval via Dynamic SVD Modulation

    May 11, 2026Yujia Cai, Boxuan Li, Chenghao Xu +1Multimodal IRVLM Adaptation

  10. DAPE: Dynamic Non-uniform Alignment and Progressive Detail Enhancement Techniques for Improving the Performance of Efficient Visual Language Models

    May 9, 2026Mengyuan Tian, Qiyan Zhao, Yanan Wang +1VLM AdaptationEfficient VLM Inference

  11. FragileFlow: Spectral Control of Correct-but-Fragile Predictions for Foundation Model Robustness

    May 9, 2026Zhuoyun Li, Boxuan Wang, Jinwei Hu +2VLM RobustnessSpectral Regularization

  12. Semantic Alignment in Hyperbolic Space for Open-Vocabulary Semantic Segmentation

    May 9, 2026Hoang M. Truong, Hai Nguyen-Truong, Dang HuynhVLM AdaptationHierarchical Representation Learning

  13. IPAD-CLIP: Teaching CLIP to Detect Image Local Perceptual Artifacts

    May 9, 2026Juan Wang, Xinyu Sun, Ke Zhang +4VLM Adaptation

  14. Decoupling Endpoint and Semantic Transition Learning for Zero-Shot Composed Image Retrieval

    May 8, 2026Mingyu Liu, Sihan Huang, Yijia Fan +4Cross-Modal LearningVLM Adaptation

  15. One Adapter, Every Resolution: Gated Low-Rank Adaptation for Remote Sensing VLMs

    May 8, 2026Song Zhang, Yanlong Chen, Yining Chen +2Remote Sensing Image UnderstandingRemote Sensing VQA

  16. Hierarchical Dual-Subspace Decoupling for Continual Learning in Vision-Language Models

    May 8, 2026Mengxin Qin, Xiang Zhang, Kun Wei +2Class-Incremental LearningVision-Language Models

  17. DIMoE-Adapters: Dynamic Expert Evolution for Continual Learning in Vision-Language Models

    May 8, 2026Mengxin Qin, Xiang Zhang, Xi Wang +3Vision-Language ModelsFine-Tuning

  18. Escaping the Diversity Trap in Robotic Manipulation via Anchor-Centric Adaptation

    May 8, 2026Yanzhe Chen, Kevin Yuchen Ma, Qi Lv +4Robot Policy AdaptationVLM Adaptation

  19. AT-VLA: Adaptive Tactile Injection for Enhanced Feedback Reaction in Vision-Language-Action Models

    May 8, 2026Xiaoqi Li, Muhe Cai, Jiadong Xu +5Contact-Rich Robotic ManipulationVLM Adaptation

  20. StrLoRA: Towards Streaming Continual Visual Instruction Tuning for MLLMs

    May 8, 2026Chang Che, Ziqi Wang, Hui Ma +2VLM AdaptationLow-Rank Adaptation

  21. Fine-tuning a vision-language model for fracture-surface morphology recognition

    May 8, 2026Quanliang Liu, Jungtaek Kim, Kangwook Lee +1VLM AdaptationMaterials Science

  22. GeoStack: A Framework for Quasi-Abelian Knowledge Composition in VLMs

    May 7, 2026Pranav Mantini, Shishir K. ShahVision-Language ModelsVLM Adaptation

  23. Plug-and-play Class-aware Knowledge Injection for Prompt Learning with Visual-Language Model

    May 7, 2026Junhui Yin, Nan Pu, Xinyu Zhang +4Prompt LearningVLM Adaptation