Vision-Language Model Adaptation

Latest papers 150

All topics
CardsList
  1. Unsupervised Long-Tailed Adaptation of Vision-Language Models

    Oct 6, 2026Keliang Chen, Yaxin Hou, Hui Liu +1Vision-Language Model Adaptation

  2. Concept Driven Domain Adaptation: Finding an Abstract Needle in a Haystack

    Oct 1, 2026Haiming Zhao, Tai Wang, Kun Zhang +2Vision-Language Model AdaptationDomain Adaptation

  3. Inline Memory Meets Reusable Skills: Memory-centric Framework for Vision-Language-Action Model

    Sep 30, 2026Zaijing Li, Rui Shao, Bing Hu +3Vision-Language Model AdaptationScalable Robot Learning

  4. Comparative study of adapting pre-trained models for driving behavior video captioning

    Sep 30, 2026Sayak Mallick, Philipp Geiger, Augustin KelavaAutonomous DrivingVision-Language Model Adaptation

  5. Data-Efficient Adaptation of a Driving VLA to Class 8 Trucks

    Sep 29, 2026Satyajeet Das, Aaron Buxbaum, Niels Joubert +1Vision-Language Model AdaptationParameter-Efficient Adaptation

  6. Inductive Visual Logic for Few-Shot Out-Of-Distribution Adaptation in VLMs

    Sep 29, 2026Hung-Jen Chen, Yu-Heng Ho, Ting-Yao Huang +4Vision-Language Model AdaptationZero-Shot

  7. Scaling Full Conformal Image Classifiers

    Sep 29, 2026Julio Silva-Rodríguez, Ender KonukogluOnline Conformal PredictionImage Classification

  8. Test-Time Generalized Category Discovery

    Sep 27, 2026Shambhavi Mishra, Omprakash Chakraborty, Julio Silva-Rodriguez +3Generalized Category DiscoveryVision-Language Model Adaptation

  9. Prompt-Anchored Residual Adaptation for Biomedical Vision-Language Models

    Sep 27, 2026Jingxuan Kang, Qianying Yue, Che Liu +1Few-Shot LearningVision-Language Model Adaptation

  10. PETR: Prompt Ensembling with Training-free Routing for Vision-Language Models

    Sep 20, 2026Weihan Cai, Hao Tan, Xinping Gao +2Multiple Prompt Learning FrameworksVision-Language Model Adaptation

  11. Not All Layers Need Tuning: Diagnosing and Directing Adaptation in Vision-Language-Action Models

    Sep 16, 2026Shahram Najam Syed, Arthur Jakobsson, Prayuj Sachdev +1Vision-Language Model AdaptationDiffusion-Based Vision-Language-Actions

  12. TecoPrompt: Temporal-Conservative Prompt Learning for Vision-Language Models

    Sep 15, 2026Zeyi Shao, Haowen Hua, Jiaxin Zhang +3Multiple Prompt Learning FrameworksContrastive Language-Image Pre-Training Model

  13. Dense to MoE Adaptation for Compact Vision Language Action Policies

    Sep 15, 2026Muchun Niu, Shuang Chen, Yuzhou Wu +1Vision-Language Model AdaptationDense

  14. VPRef: A Cross-Domain Benchmark for Referring Remote Sensing Image Segmentation

    Sep 15, 2026Quanwei Liu, Tao Huang, Jiaqi Yang +1Remote Sensing Image SegmentationVision-Language Model Adaptation

  15. Option-Aware Retrieval and Task-Specific VLM Adaptation for Medical VQA

    Sep 14, 2026Tristan Kirscher, Niklas C. Koser, Soren PirkMedical Visual Question AnsweringMultiple-Choice Questions

  16. Pre-PEFT Probing: Weight Statistics and Perturbation Robustness for Layer Selection in VLM Vision Encoders

    Sep 14, 2026Qingtao Xia, Jiahua Bao, Siyao Cheng +1Parameter-Efficient Fine-Tuning MethodsVision-Language Model Adaptation

  17. On-Policy Distillation for Vision-Language Model Adaptation, an Effective Paradigm on Low-Quality Multimodal Data

    Sep 9, 2026Hongyuan Zhang, Xianda Guo, Yanlun Peng +6Vision-Language Model AdaptationParameter-Efficient Adaptation

  18. To Adapt or Not to Adapt? Selective Adaptation for Vision-Language Models

    Sep 8, 2026Siru Jiang, Yuwei Liang, Jian Liang +2Vision-Language Model AdaptationTest-Time Adaptation

  19. Test-Time Logit Prompting for Source-Free Missing Modality Adaptation

    Sep 2, 2026Taixi Chen, Nancy GuoVision-Language Model AdaptationLogit Lens

  20. DESA-TTA: Dynamic EMA and Source Anchoring for Test-Time Adaptation

    Sep 1, 2026Atif Belal, Lilian Hollard, Marco Pedersoli +1Stable Test-Time AdaptationTest-Time Adaptation

  21. Text Capability Loss in Vision-Language Adaptation: An Attention-Sink Diagnosis

    Sep 1, 2026Minsik Choi, Geewook Kim, Young Geun KimVision-Language Model AdaptationDynamic Attention

  22. Seeing the Unseen: Visual Similarity for Pixel Language Model Adaptation

    Aug 31, 2026Ran Zhang, Miryam de Lhoneux, Wessel PoelmanCross-Lingual TransferVision-Language Model Adaptation

  23. Towards Continual Test-Time Adaptation of Vision-Language Models in Open-Vocabulary Semantic Segmentation

    Aug 30, 2026Chandler Timm C. Doloriel, Yunbei Zhang, Sarthak Kumar Maharana +5Vision-Language Model AdaptationOpen-Vocabulary Segmentation

  24. DistMoE: Private-data Rehearsal-free Routing in Mixture-of-Experts for Distributed Instruction Tuning

    Aug 10, 2026Mainak Singha, Niccolò Biondi, Elisa Ricci +1Multimodal Continual Instruction TuningMixture-Of-Experts

  25. Triple Expert Learning from Noisy Labels for Semi-Supervised Vision Foundation Model Adaptation

    Aug 10, 2026Xuanyu Liu, Zheng Fang, Hongyang He +2Vision-Language Model AdaptationRecent Vision Foundation Models

  26. MuST-VAD: Mutual Structured Learning for Video Anomaly Detection

    Aug 7, 2026Satoshi Hashimoto, Hitoshi Nishimura, Mori KurokawaTraining-Free Video Anomaly DetectionFine-Grained Video Understanding

  27. When Semantics Saturate or Emerge: Adaptation-Conditional Semantic Utility in Source-Free Cross-Domain Few-Shot Learning

    Aug 7, 2026Wei Liu, Xing Deng, Haijian ShaoFew-Shot LearningVision-Language Model Adaptation

  28. DARAD: Dual Adapters and Ranking-Aware Distillation for Continual Remote Sensing Image-Text Retrieval

    Aug 6, 2026Xi Chen, Xu Chen, Xiangyang Jia +3Remote SensingCross-Modal Distillation

  29. Respect Your Zero-Shot Uncertainty: Conservative Calibration for Test-Time-Adapted Vision-Language Models

    Aug 6, 2026Jingyan Jiang, Yaru Sun, Xiao Chen +5Vision-Language Model AdaptationZero-Shot Robustness

  30. On the Effectiveness of Adaptation Strategies for VLM-Based Federated Learning in Remote Sensing

    Aug 5, 2026Simon Lösche, Barış Büyüktaş, Mathis Adler +3Federated LearningVision-Language Model Adaptation

  31. COSMO: Consensus-Driven Shift Modulation for Source-Free Domain Adaptation

    Aug 5, 2026Bo Li, Junjie Peng, Xiaohua Xie +1Domain AdaptationVision-Language Model Adaptation

  32. MuRA: Multi-Rank Adaptation for Efficient and Effective Test-Time Vision-Language Generalization

    Aug 4, 2026Gengyuan Liu, Nanzhou Wang, Chang Liu +5Vision-Language Model AdaptationTest-Time Adaptation

  33. Local Margin Restoration for Test-Time Adaptation of Vision-Language Models

    Aug 3, 2026Yan Huang, Guowei Wang, Xu Wang +2Vision-Language Model AdaptationTest-Time Adaptation

  34. Visual Distribution Anchoring for Efficient Prompt Tuning

    Jul 31, 2026Pouya Parsa, Raoof Zare Moayedi, Seongjin ChoiVision-Language Model AdaptationSoft Prompt Tuning

  35. Mitigating Class-Tail Undercoverage in Medical Vision-Language Models under Clinical Shift

    Jul 30, 2026Mushir Akhtar, M. TanveerMedical Vision-Language ModelsVision-Language Model Adaptation

  36. Continual Video-MLLM Adaptation over Evolving Domains

    Jul 21, 2026Rui Cheng, Meixing Shi, Yuxiang Cai +3Vision-Language Model AdaptationDomain Adaptation

  37. PRiSM: Prototype Regularization for Few-Shot VLMs

    Jul 20, 2026Ghassen Baklouti, Omprakash Chakraborty, Jose Dolz +1Few-Shot LearningVision-Language Model Adaptation

  38. Can Experts Adapt Without Training? On Test-Time Modality Generalization in MVLMs

    Jul 18, 2026Raza Imam, Darakshan Rashid, Yutong Xie +3Vision-Language Model AdaptationMedical Vision-Language Models

  39. Von Mises-Fisher Mixture Model with Dynamic Shrinkage for Realistic Test-Time Transduction

    Jul 17, 2026Jiazhen Huang, Zhiming Liu, Changhu Wang +3Vision-Language Model AdaptationTransductive Learning

  40. When Can Test-Time Adaptation Help Zero-Shot CT Vision-Language Models?

    Jul 17, 2026Ailar Mahdizadeh, Puria Azadi Moghadam, Xiangteng He +1Vision-Language Model AdaptationStable Test-Time Adaptation

  41. MQAdapter: Multi-Modal Quantum Adapter for Coarse-to-Fine VLM Fine-tuning

    Jul 14, 2026Yumiao Zhao, Bo Jiang, Min Lu +2Vision-Language Model AdaptationRecent Vision-Language Models

  42. An Empirical Analysis of Continual Learning for Heterogeneous Medical Visual Question Answering

    Jul 13, 2026Mai A. Shaaban, Tausifa Jan Saleem, Alaa Mohamed +3Medical Visual Question AnsweringReplay-Based Continual Learning

  43. MED-DSLC: Multi-Expert-Domain Classification via Domain Supervision and Logit Calibration

    Jul 13, 2026Zheng Zeng, Deepak Sridhar, Nuno VasconcelosVision-Language Model AdaptationIn-Domain Accuracy

  44. TCLA: Training-Free Class-wise Logit Adaptation for Medical Vision-Language Models

    Jul 10, 2026Tianyou Jiang, Ziyu ZhouVision-Language Model AdaptationMedical Vision-Language Models

  45. Robustifying Vision-Language Models via Test-Time Prompt Adaptation

    Jul 10, 2026Xingyu Zhu, Huanshen Wu, Shuo Wang +4Vision-Language Model AdaptationRecent Vision-Language Models

  46. Parameter-Efficient Vision-Language Adaptation with Continuous Metadata Conditioning for Animal Re-Identification

    Jul 10, 2026Anil Osman Tur, Tonje Knutsen Sordalen, Kim Tallaksen Halvorsen +1Animal Re-IdentificationVision-Language Model Adaptation

  47. When Prompts Ignore Structure: Graph-Based Attribute Reasoning for Calibrated VLMs

    Jul 8, 2026Tanay Sodha, Aditya Sharma, Ramya Hebbalaguppe +2Vision-Language Model AdaptationRecent Vision-Language Models

  48. Comparative Study of Domain-adapted VLMs for General Document Visual Question Answering

    Jul 8, 2026Miguel Lopez-Duran, Elena Marrero, Julian Fierrez +8Vision-Language Model AdaptationComparison

  49. MonoIR-RS: Infrared Remote Sensing Vision-Language Learning with CLIP and VLM Adaptation

    Jul 7, 2026Jiaju Han, Ma Yaqi, Yahui Chai +8InfraredRemote Sensing

  50. SAMPLe: SAM-based Optimizer for Prompt Learning in VLMs

    Jul 7, 2026Hossein Rajoli, Fatemeh Lotfi, Niloufar Alipour Talemi +3Multiple Prompt Learning FrameworksVision-Language Model Adaptation

  51. Cross-Contextual Vision-Language Adaptation with LoRA for Personalized Severe Adverse Event Detection in Clinical Wound Monitoring

    Jul 6, 2026Aditi Naiknaware, Jian Sun, Aminreza Khandan +4Medical Vision-Language ModelsMultimodal Clinical Data

  52. USE: A Unified Self-Ensembling Framework for Test-Time Prompt Tuning

    Jul 4, 2026Siru Jiang, Jian Liang, Ran He +1Vision-Language Model AdaptationSoft Prompt Tuning

  53. AnyGroundBench: A Multi-Domain Adaptation Benchmark for Video Grounding in VLMs

    Jul 2, 2026Rintaro Otsubo, Ryo Fujii, Reina Ishikawa +6Video Temporal GroundingVision-Language Model Adaptation

  54. AdaBoosting Text Prompts for Vision-Language Models

    Jul 1, 2026Seokhee Jin, Changhwan Sung, Sunung Mun +2Vision-Language Model AdaptationFew-Shot Learning