VLM Adaptation

VLM: Vision-Language Model

Latest papers 395

All topics
CardsList
  1. CLIP-AUTT: Test-Time Personalization with Action Unit Prompting for Fine-Grained Video Emotion Recognition

    Mar 30, 2026Muhammad Osama Zeeshan, Masoumeh Sharafi, Benoit Savary +3VLM AdaptationFacial Expression Recognition

  2. Project and Mix: Task-Semantic Prototypes for Few-Shot Image Classification

    Mar 25, 2026Dipam Goswami, Simone Magistri, Gido M. van de Ven +4Prototype-Based LearningVLM Adaptation

  3. Guided Prompt Evolution for Vision-Language Models Adaptation

    Mar 10, 2026Enming Zhang, Jiayang Li, Yanlong Wang +3VLM AdaptationFew-Shot Learning

  4. GreenRFM: Learning a resource-efficient radiology vision-language foundation model via supervision-centric pre-training

    Mar 6, 2026Yingtai Li, Shuai Ming, Qiuli Wang +13Medical Imaging Foundation ModelsRadiology VLMs

  5. ProtoDCS: Towards Robust and Efficient Open-Set Test-Time Adaptation for Vision-Language Models

    Feb 27, 2026Wei Luo, Yangfan Ou, Jin Deng +4VLM RobustnessTest-Time Adaptation

  6. MMLoP: Multi-Modal Low-Rank Prompting for Efficient Vision-Language Adaptation

    Feb 24, 2026Sajjad Ghiasvand, Haniyeh Ehsani Oskouie, Mahnoosh Alizadeh +1Cross-Modal LearningPrompt Learning

  7. Spectral Imbalance Causes Forgetting in Low-Rank Continual Adaptation

    Jan 31, 2026Hao Gu, Mao-Lin Luo, Zi-Hao Zhou +3VLM AdaptationContinual Learning

  8. From One-to-One to Many-to-Many: Dynamic Cross-Layer Injection for Deep Vision-Language Fusion

    Jan 15, 2026Cheng Chen, Yuyu Guo, Pengpeng Zeng +4Vision-Language ModelsVLM Adaptation

  9. PEST: Parameter Efficient Steering of Blackbox VLMs via Agentic Few-shot Alignment for Hateful Meme Moderation

    Jan 8, 2026Naquee Rizwan, Subhankar Swain, Paramananda Bhaskar +3VLM AdaptationHate Speech Detection

  10. Rethinking Fine-Tuning: Unlocking Hidden Capabilities in Vision-Language Models

    Dec 28, 2025Mingyuan Zhang, Yue Bai, Yifan Wang +2Fine-TuningVLM Adaptation

  11. From Words to Wavelengths: VLMs for Few-Shot Multispectral Object Detection

    Dec 17, 2025Manuel Nkegoum, Minh-Tan Pham, Élisa Fromont +2VLM AdaptationMultispectral Object Detection

  12. Parameter Efficient Multimodal Instruction Tuning for Romanian Vision Language Models

    Dec 16, 2025George-Andrei Dima, Răzvan-Alexandru Smădu, Dumitru-Clementin CercelVisual Question AnsweringImage Captioning

  13. Solving Semi-Supervised Few-Shot Learning from an Auto-Annotation Perspective

    Dec 11, 2025Tian Liu, Anwesha Basu, James Caverlee +1VLM AdaptationFew-Shot Learning

  14. How (Mis)calibrated is your Federated CLIP and what to do about it?

    Dec 3, 2025Mainak Singha, Masih Aminbeidokhti, Paolo Casari +3Vision-Language ModelsVLM Adaptation

  15. Thinking Ahead: Foresight Intelligence in MLLMs and World Model

    Nov 24, 2025Zhantao Gong, Liaoyuan Fan, Qing Guo +3VLM EvaluationVLM Adaptation

  16. BOFA: Bridge-Layer Orthogonal Low-Rank Fusion for CLIP-Based Class-Incremental Learning

    Nov 14, 2025Lan Li, Tao Hu, Da-Wei Zhou +3Class-Incremental LearningVLM Adaptation

  17. Cross-Task Generalization in Handwriting-Based Alzheimer's Screening via Vision Language Adaptation

    Nov 8, 2025Changqing Gong, Huafeng Qin, Mounim A. El-YacoubiAlzheimer's DiseaseVLM Adaptation

  18. VisCoP: Visual Probing for Video Domain Adaptation of Vision Language Models

    Oct 15, 2025Dominick Reilly, Manish Kumar Govind, Le Xue +1Domain AdaptationVLM Adaptation

  19. VLOD-TTA: Test-Time Adaptation of Vision-Language Object Detectors

    Oct 1, 2025Atif Belal, Heitor R. Medeiros, Marco Pedersoli +1Open-Vocabulary Object DetectionVLM Robustness

  20. HERMAN: Hierarchical Representation Matching for CLIP-based Class-Incremental Learning

    Sep 26, 2025Zhen-Hao Xie, Yan Wang, Lan Li +3Class-Incremental LearningVision-Language Models

  21. CoDoL: Conditional Domain Prompt Learning for Out-of-Distribution Generalization

    Sep 18, 2025Min Zhang, Yuyin Wang, Zhongxiang Dai +4VLM AdaptationDomain Generalization

  22. PlantExpertVQA: A Visual Question Answering Dataset for Benchmarking Vision-Language Models in Plant Science

    Aug 23, 2025Syed Nazmus Sakib, Nafiul Haque, Mohammad Zabed Hossain +1VLM EvaluationAgricultural Image Analysis

  23. AD-FM: Multimodal LLMs for Anomaly Detection via Multi-Stage Reasoning and Fine-Grained Reward Optimization

    Aug 6, 2025Jingyi Liao, Yongyi Su, Rong-Cheng Tu +6VLM AdaptationIndustrial Anomaly Detection

  24. NEARL: Interacted Query Adaptation with Orthogonal Regularization for Medical Vision-Language Understanding

    Aug 6, 2025Zelin Peng, Yichen Zhao, Yu Huang +5Cross-Modal LearningVLM Adaptation

  25. CLIP-Powered Domain Generalization and Domain Adaptation: A Comprehensive Survey

    Apr 19, 2025Jindong Li, Yongguang Li, Yali Fu +4Source-Free Domain AdaptationDomain Adaptation

  26. FORGE: Forensic Reasoning with Grounded Evidence

    Mar 20, 2025Rohit Kundu, Shan Jia, Vishal Mohanty +2VLM AdaptationExplainable Deepfake Detection

  27. Concept-as-Tree: A Controllable Synthetic Data Framework Makes Stronger Personalized VLMs

    Mar 17, 2025Ruichuan An, Kai Zeng, Ming Lu +5Synthetic Data AugmentationVision-Language Models

  28. From My View to Yours: Learning Egocentric Cues from Exocentric Video using Privileged Egocentric Supervision

    Jan 10, 2025Dominick Reilly, Manish Kumar Govind, Le Xue +1Video UnderstandingVLM Adaptation

  29. Enhanced Vision-Language Models for Diverse Sensor Understanding: Cost-Efficient Optimization and Benchmarking

    Dec 30, 2024Sangyun Chung, Youngjoon Yu, Se Yeon Kim +2VLM EvaluationVision-Language Models