Visual Prompt Learning

Latest papers 78

All topics
CardsList
  1. Structured-Condensed Prompt Tuning in Vision-Language Models for Fine-grained Image Recognition

    Jul 7, 2026Xinda Liu, Qinyu Zhang, Weiqing Min +2VLM AdaptationFine-Grained Image Classification

  2. SAMPLe: SAM-based Optimizer for Prompt Learning in VLMs

    Jul 7, 2026Hossein Rajoli, Fatemeh Lotfi, Niloufar Alipour Talemi +3Sharpness-Aware MinimizationVLM Adaptation

  3. Learning Probabilistic Prompt for Continual Learning

    Jul 6, 2026Hyekang Park, Sanghoon Lee, Geon Lee +2Class-Incremental LearningPrompt Learning

  4. Hidden-Shot: Towards One-Shot Task Generalization for Low-Level Vision Generalist Models

    Jul 1, 2026Shao-Jun Xia, Xianzheng Ma, Zichong MengVision Foundation Model AdaptationFew-Shot Learning

  5. CPG-PAD: Concept-Informed Prompts Guided Presentation Attack Detection

    Jul 1, 2026Haoyuan Zhang, Xiangyu Zhu, Li Gao +3VLM AdaptationDomain Generalization

  6. Learning from Reliable Latent Prompts for Visual Recognition with Missing Modalities

    Jun 29, 2026Taixi Chen, Nancy GuoMissing-Modality LearningPrompt Learning

  7. Decoupling Semantics and Geometric Grounding: Spatial Visual Prompts for Language-Conditioned Imitation Learning

    Jun 24, 2026Yanzhe Tang, Xinyu Shao, Yuxuan Hu +6Language-Conditioned Robot ManipulationVision-Language Grounding

  8. BioMedVR: Confusion-Aware Mixture-of-Prompt Experts for Biomedical Visual Reprogramming

    Jun 23, 2026Jiaxiang Liu, Tianxiang Hu, Juwei Guan +5VLM AdaptationMedical VLMs

  9. BoxCtrl: 3D-Aware Visual Prompting for Geometric Image Editing

    Jun 22, 2026Feifei Wang, Shiyuan Yang, Xiaoyu Li +1Image EditingVisual Prompt Learning

  10. Fine-tuning Multi-modal LLMs with ART: Art-based Reinforcement Training

    Jun 10, 2026Michal Chudoba, Sergey Alyaev, Petra Galuscakova +1LLM Fine-TuningMultimodal Large Language Models

  11. Visual Prompting Meets Feature Reconstruction-Based Anomaly Detection with Dual-Teacher Supervision

    Jun 8, 2026Mateo Diaz-Bone, Daniel Caraballo, Florian Scheidegger +11Anomaly LocalizationReconstruction-Based Anomaly Detection

  12. Zero-Shot Learning in Industrial Scenarios: New Large-Scale Benchmark, Challenges and Baseline

    Jun 6, 2026Zekai Zhang, Qinghui Chen, Maomao Xiong +6VLM AdaptationIndustrial Anomaly Detection

  13. Unification of Closed-Open Industrial Detection Scenarios: New Large-Scale Benchmarks,Challenges and Baselines

    Jun 6, 2026Zekai Zhang, Jinglin Zhang, Qinghui Chen +8Open-Vocabulary Object DetectionVLM Adaptation

  14. Geometry-Aware Distillation for Prompt Tuning Biomedical Vision-Language Models

    Jun 3, 2026Tran Dinh Tien, Zhiqiang ShenVLM AdaptationVLM Distillation

  15. Imagine Before You Draw: Visual Prompt Engineering for Image Generation

    Jun 3, 2026Liyu Jia, Fengda Zhang, Jiachun Pan +7Conditional Image GenerationT2I Generation

  16. Beyond Low-Rank: Low-Rank Sparse Prompting via Spiking Neural Network and Prompt Factorization

    Jun 1, 2026Yumiao Zhao, Bo Jiang, Beibei Wang +3Vision Foundation Model AdaptationLow-Rank Adaptation

  17. Personalize Your Large Vision-language Models With In-context Prompt Tuning

    May 29, 2026Yanshu Li, Jiaqian Li, Kuai Yu +4Vision-Language ModelsLarge Vision-Language Models

  18. BadBone: Backdoor Attacks Against Backbone Models in Visual Prompt Learning

    May 29, 2026Ziqing Yang, Rui Wen, Xinlei He +3Adversarial AttacksBackdoor Attacks

  19. FedMPT: Federated Multi-label Prompt Tuning of Vision-Language Models

    May 27, 2026Xucong Wang, Pengkun Wang, Zhe Zhao +3Multi-Label ClassificationVLM Adaptation

  20. LV-OSD: Language-Vision-Complementary Open-Set Object Detection

    May 27, 2026Yupeng Zhang, Ruize Han, Wei Feng +2Open-Vocabulary Object DetectionObject Detection

  21. Leveraging Text-to-Image Diffusion Models for Unsupervised Visual Object Tracking

    May 26, 2026Zhengbo Zhang, Zhigang Tu, Junsong Yuan +2Visual Object TrackingVisual Prompt Learning

  22. HydraPrompt: An Adaptive and Asymmetric Framework of Vision-Language Models for Synthetic Image Detection

    May 26, 2026Senyuan Shi, Hao Tan, Zichang Tan +4Image Forgery DetectionVLM Adaptation

  23. Image-Conditioned Instance Prompt Network for Referring Remote Sensing Image Segmentation

    May 23, 2026Biaoyu Ren, Qingsheng Wang, Cun Xu +2Remote Sensing Image SegmentationReferring Image Segmentation

  24. LaCoVL-FER: Landmark-Guided Contrastive Learning Network with Vision-Language Enhancement for Facial Expression Recognition

    May 19, 2026Jiaxin Wang, Muwei Jian, Hui Yu +2VLM AdaptationFacial Expression Recognition

  25. Dual-Prompt CLIP with Hybrid Visual Encoders for Occluded Person Re-Identification

    May 19, 2026Zhangjian Ji, Shaotong Qiao, Kai Feng +1Visual Prompt LearningPerson Re-Identification

  26. Exposing Functional Fusion: A New Class of Strategic Backdoor in Dynamic Prompt Architectures

    May 19, 2026Zeyao Liu, Zhendong Zhao, Xiaojun Chen +3Adversarial AttacksVision Transformer

  27. WOW-Seg: A Word-free Open World Segmentation Model

    May 16, 2026Danyang Li, Tianhao Wu, Bin Li +5Image SegmentationOpen-Set Recognition

  28. Cluster-Aware Neural Collapse Prompt Tuning for Long-Tailed Generalization of Vision-Language Models

    May 12, 2026Boyang Guo, Liang Li, Lin Peng +3Long-Tail LearningVLM Adaptation