Continual Learning for VLMs

VLM: Vision-Language Model

Latest papers 51

All topics
CardsList
  1. ReCAP: Retrieval-Guided Capability Reuse for Multimodal Continual Instruction Tuning

    Sep 29, 2026Tao Hu, Zhinuo Zhou, Xialiang Tong +2Continual LearningContinual Learning for VLMs

  2. Visual Branch is What You Need for CLIP-based Class-Incremental Learning

    Sep 29, 2026Tao Hu, Zhen-Hao Xie, Jingcai Guo +2Class-Incremental LearningModality Gap in VLMs

  3. Dual-Mode Low-Rank Learner with Bridge-Prototype Ensemble for Vision-Language Class-Incremental Learning

    Sep 29, 2026Chiyuan He, Zihuan Qiu, Fanman Meng +5Prototype-Based LearningLow-Rank Adaptation

  4. Brain-Inspired Hierarchical Modularity for General Continual Learning

    Sep 21, 2026Hongwei Yan, Kanglei Zhou, Qi Cheng +7Continual Learning for LLMsContinual Learning for VLA Models

  5. ReDraft, Don't Just Distill: Reference-Driven Revision for Continual VLLM Post-Training

    Sep 15, 2026Zhihao Zhang, Mingqi Wu, Qiaole Dong +15Fine-TuningMultimodal Large Language Models

  6. AnchorGUI: Asymmetric Memory for Dual-Scale Learning in GUI Navigation

    Sep 14, 2026Shengjie Jin, Zelong Sun, Hengbo Xu +2Memory-Augmented VLMsContinual Learning for VLMs

  7. Towards Continual Test-Time Adaptation of Vision-Language Models in Open-Vocabulary Semantic Segmentation

    Aug 30, 2026Chandler Timm C. Doloriel, Yunbei Zhang, Sarthak Kumar Maharana +5Test-Time Adaptation of VLMsOpen-Vocabulary Semantic Segmentation

  8. DARAD: Dual Adapters and Ranking-Aware Distillation for Continual Remote Sensing Image-Text Retrieval

    Aug 6, 2026Xi Chen, Xu Chen, Xiangyang Jia +3VLM AdaptationImage-Text Retrieval

  9. Taming the Implicit: Dual-Channel Risk-Aware Reinforcement Fine-Tuning for Continual Multimodal Post-Training

    Aug 4, 2026Yibei Liu, Jiajun Chen, Qianle Zhang +4Multimodal Large Language ModelsRisk-Sensitive RL

  10. SAFE-Merge: Data-Free Continual Model Merging with General Knowledge Preservation

    Aug 2, 2026Zihuan Qiu, Zhiyang Liao, Chiyuan He +5Language Model MergingModel Merging

  11. Progressive Multimodal Alignment for Continual Instruction Tuning

    Jul 29, 2026Duzhen Zhang, Yahan Yu, Qiaoyi Su +2Cross-Modal AlignmentMultimodal Large Language Models

  12. Continual Video-MLLM Adaptation over Evolving Domains

    Jul 21, 2026Rui Cheng, Meixing Shi, Yuxiang Cai +3Video QADomain-Incremental Learning

  13. AlphaWiSE: Adaptive Weight Interpolation for Continual Multimodal Representation Learning

    Jul 16, 2026Sarthak Jain, Qiran Hu, Zhen Zhu +1Cross-Modal Representation LearningCross-Modal Alignment

  14. An Empirical Analysis of Continual Learning for Heterogeneous Medical Visual Question Answering

    Jul 13, 2026Mai A. Shaaban, Tausifa Jan Saleem, Alaa Mohamed +3Medical VQAContinual Learning for VLMs

  15. RL Forgets! Towards Continual Policy Optimization

    Jul 5, 2026Mao-Lin Luo, Zhe-Xu Wang, Zi-Hao Zhou +4RL Post-TrainingContinual Learning for VLMs

  16. CL-Anomaly: Layer-Adaptive Mixture-of-Experts with Multimodal Large Language Model for Continual Learning in Anomaly Detection

    Jul 3, 2026Wen Dong, Zhao Wang, Shuangqing Zhang +5Mixture of ExpertsMultimodal Large Language Models

  17. Hidden Forgetting in Continual Multimodal Learning: When Accuracy Survives but Grounding Fails

    Jul 2, 2026Qianyu Chen, Canran Xiao, Runxuan TangMultimodal GroundingMultimodal Foundation Models

  18. InduceKV: Fixed-Footprint Continual Adaptation of Multimodal LLMs via Inducing KV Memories

    Jul 2, 2026Qianyu Chen, Ziteng Feng, Canran Xiao +1Continual Learning for LLMsMemory-Efficient Fine-Tuning

  19. Wake up for Touch! Mask-isolated Tactile Alignment Learning in MLLMs

    Jul 1, 2026Yoonhyung Park, Minji Kim, Sungwon Moon +1Visuo-Tactile Representation LearningMultimodal Large Language Models

  20. Rosetta: Composable Native Multimodal Pretraining

    Jul 1, 2026Xiangyue Liu, Zijian Zhang, Miles Yang +3Unified Multimodal ModelsMultimodal Pretraining

  21. Few-Shot Domain Incremental Learning via Continual Vision-Language Consolidation

    Jun 29, 2026Naeem Paeedeh, Mahardhika Pratama, Wolfgang Mayer +3VLM AdaptationDomain-Incremental Learning

  22. ComMem: Complementary Memory Systems for Test-Time Adaptation of Vision-Language Models

    Jun 27, 2026Guanglong Sun, Shuang Cui, Bo Lei +6Memory-Augmented VLMsVision-Language Models

  23. ReasonCLIP-58M: Visually Grounded Commonsense Reasoning Supervision for CLIP

    Jun 25, 2026Sicheng Zhang, Muzammal Naseer, Binzhu Xie +5Compositional ReasoningMultimodal Reasoning

  24. CADRE: Stable, Parameter Efficient Adaptation of Medical Vision Language Models with Bounded Forgetting and Prior Drift

    Jun 22, 2026Amrita Singh, Rishabh JhaVLM AdaptationElastic Weight Consolidation

  25. Attention-Spectrum Regularization for Replay-Free Continual Multimodal LLMs

    Jun 22, 2026Chuangxin Zhao, Canran Xiao, Siyuan Ma +5Visual Question AnsweringCross-Modal Attention

  26. Black-Box Continual Learning for Vision-Language Models

    Jun 22, 2026Yuting Li, Weihang Fang, Haoyuan Gao +4Incremental LearningContinual Learning for VLMs

  27. Is Our Benchmark Enough? An Analysis of Continual Learning for MLLMs

    Jun 18, 2026Van-Tuan Tran, Shruthi Gowda, Merim Dzaferagic +1Continual LearningLLM Routing