Visual Prompt Learning

Latest papers 78

All topics
CardsList
  1. Seeing the Invisible: Physics-Guided Visual Prompting for Temperature- and Radiation-Aware VLA Navigation

    Oct 6, 2026Hojoon Son, Fan ZhangSafe Robot NavigationVision-Language Navigation

  2. Reprogramming Vision-Language Models via Structured Prompt Reparameterization

    Sep 29, 2026Zizhao Li, Chengyi Cai, Mohammed Yaqoob Ansari +3VLM AdaptationFew-Shot Image Classification

  3. You Only Reprogram Once: Rethinking Prolonged Training for Visual Reprogramming

    Sep 29, 2026Zizhao Li, Mohammed Yaqoob Ansari, Xinyu Su +3VLM AdaptationVision Foundation Model Adaptation

  4. Gaze Prompts: Temporally Dense Human Attention for Vision-Language-Action Fine-Tuning

    Sep 28, 2026Yihan Zhou, Rui Yan, Mingcong Li +4Visuomotor Policy LearningRobotic Manipulation

  5. PETR: Prompt Ensembling with Training-free Routing for Vision-Language Models

    Sep 20, 2026Weihan Cai, Hao Tan, Xinping Gao +2Zero-Shot LearningVLM Adaptation

  6. GAPrompt++: Multi-Granular Geometry-Aware Point Cloud Prompt for 3D Vision Model

    Sep 17, 2026Zixiang Ai, Zhenyu Cui, Yufei Guo +4Point Cloud LearningVision Foundation Model Adaptation

  7. TecoPrompt: Temporal-Conservative Prompt Learning for Vision-Language Models

    Sep 15, 2026Zeyi Shao, Haowen Hua, Jiaxin Zhang +3Prompt LearningNoisy-Label Learning

  8. PSMP-CLIP: Patch-Prompt SAM and Multi-Semantic Prompting for CLIP-Based Zero-Shot Anomaly Detection

    Sep 15, 2026Xuezhi Xiang, Guanghao Wu, Heqi Xiang +4Promptable Image SegmentationAnomaly Localization

  9. Low-Rank Prompt Learning for Vision-Language Models with Fixed-Token Bases

    Sep 8, 2026Tanvir Muntakim Tonoy, Sajjad Ghiasvand, Mahnoosh Alizadeh +1Vision-Language ModelsPrompt Learning

  10. Motion-as-Prompt: Enhancing Motion Reasoning in Multimodal Large Language Models via Motion-Guided Cross-Frame Visual Prompting

    Aug 12, 2026Xikai Sun, Kebin Liu, Haotian Wang +3Video ReasoningVLM Reasoning

  11. Evaluating Semantic and Spatial Guidance for Foundation Model Segmentation of Small-Scale PV in Remote Sensing Imagery

    Aug 11, 2026Roni Blushtein-Livnon, Tal Svoray, Osher Rafaeli +4Remote Sensing Image SegmentationPromptable Image Segmentation

  12. ZOMP: Zeroth-Order Multi-Modal Prompt Tuning for Vision-Language Models

    Aug 8, 2026Sajjad Ghiasvand, Yifan Yang, Mahnoosh Alizadeh +1VLM AdaptationZeroth-Order Optimization

  13. Adapting Vision Foundation Models with Cascaded Semantics

    Aug 5, 2026Xi Xiao, Xingjian Li, Cheng Han +8Vision Foundation Model AdaptationVisual Prompt Learning

  14. UniEvo-RS: Omni-Prompt Unified Remote Sensing Segmentation with Representative Exemplar-Driven Prototype Evolution

    Aug 4, 2026Kunquan Zhang, Peilang Li, Xikun Hu +4Remote Sensing Image SegmentationTest-Time Adaptation

  15. SeCo-SBIR: Semantically Consistent Prompt Learning for Zero-Shot Sketch-Based Image Retrieval

    Aug 4, 2026Long Hoang Dang, Tuan Nguyen Huu, Nguyen Minh Hieu +1VLM AdaptationCross-Modal Retrieval

  16. USP-Mamba: Unmixing-Derived Spectral and Structural Prompting for Hyperspectral Image Super-Resolution

    Aug 3, 2026Shi Chen, Jie Zhang, Yicong ZhouMambaHyperspectral Image Super-Resolution

  17. Mitigating Visual Degradation in MLLMs via Spatial-Spectral Visual Anchor Learning

    Aug 3, 2026Qianlong Yang, Bowen Ye, Xianda Guo +4VLM RobustnessMultimodal Large Language Models

  18. ViP-Rig: Visual-Prompted Controllable Rigging

    Jul 30, 2026Zihan Qin, Mingze Sun, Yifan Mao +6Visual Prompt Learning

  19. Visual prompt engineering for video models

    Jul 28, 2026Robert Geirhos, Yuxuan Li, Thaddäus Wiedemer +7Video ReasoningVisual Prompt Learning

  20. Rethinking Expert Training for Model Merging with Prompt Learning

    Jul 27, 2026Christos Georgakilas, Aniello Panariello, Samir El Karrat Moreno +3VLM AdaptationMulti-Task Learning

  21. Rethinking Layer-Wise Information Allocation for Vision Foundation Model Adaptation

    Jul 24, 2026Yuqi Li, Xi Xiao, Yunbei Zhang +6Information BottleneckVision Foundation Model Adaptation

  22. DINO-VPT: Hierarchical Visual Prompt Tuning for Joint Physical-Digital Face Anti-Spoofing

    Jul 23, 2026Pierre Gallin-Martel, Mika Feng, Koichi Ito +1Vision Foundation Model AdaptationFace Presentation Attack Detection

  23. Parameter-efficient Prompt Tuning of Vision Foundation Model With Adaptive Focal Loss for Interpretable MCI Screening

    Jul 16, 2026Javad Khoramdel, Farhad Hoseyni, Amirhossein NikoofardClass-Imbalanced LearningVision Foundation Model Adaptation

  24. U-shaped Multi-granularity Learning for Vision-Language Models

    Jul 16, 2026Biao Chen, Yunqian Yu, Xiangxu Zhao +3VLM AdaptationVisual Prompt Learning

  25. MagicPrompt: Ultra-Lightweight Prompt Tuning for Video Generation

    Jul 16, 2026Yinhan Zhang, Dinwei Tan, Xianghao Kong +3Video Diffusion ModelsDiffusion Model Fine-Tuning

  26. ViPSAM: Visual Prompting Medical Image Segmentation Using Segment Anything Model

    Jul 15, 2026San Lee, Nalee Kim, Jeong Il Yu +2Cross-Modality Medical Image SegmentationPromptable Image Segmentation

  27. Parameter-Efficient Vision-Language Adaptation with Continuous Metadata Conditioning for Animal Re-Identification

    Jul 10, 2026Anil Osman Tur, Tonje Knutsen Sordalen, Kim Tallaksen Halvorsen +1Animal Re-IdentificationDistribution Shift

  28. Simon-SR: Spatially Adaptive Modulation and Visual Prompt Adaptation for Text-Reinforced Super-Resolution

    Jul 10, 2026Haotong Cheng, Yuxuan Li, Zijie CuiMultimodal FusionVisual Prompt Learning