Contrastive Language-Image Pre-Training Model

Latest papers 76

All topics
CardsList
  1. When Masking Helps or Hurts Robustness in Compressed CLIP: A Pre-Deployment Diagnostic

    Sep 30, 2026Muhammad Zawish, Steven DavyVisual Token PruningMask2Former

  2. ShieldCLIP: Selective Safety Alignment for Harmful Content Mitigation in Multimodal Foundation Models

    Sep 30, 2026Tobia Poppi, Silvia Cappelletti, Samuele Poppi +4Safety AlignmentContrastive Language-Image Pre-Training Model

  3. Reprogramming Vision-Language Models via Structured Prompt Reparameterization

    Sep 29, 2026Zizhao Li, Chengyi Cai, Mohammed Yaqoob Ansari +3Contrastive Language-Image Pre-Training ModelIntra-Class

  4. A Visual Classification Dataset and Model Evaluation for Historical Manuscript Illustrations

    Sep 27, 2026Yoav Evron, Michal Bar-Asher Siegal, Michael FireVision DatasetsHistorical Manuscripts

  5. HyperCLIP++: Fine-tuning CLIP forOpen-vocabulary Semantic Segmentation in Hyperbolic Space

    Sep 21, 2026Zelin Peng, Zhengqin Xu, Changsong Wen +4Contrastive Language-Image Pre-Training ModelOpen-Vocabulary Segmentation

  6. Retrieval Geometry Shapes Cache-Based Clip Adaptation

    Sep 20, 2026Mahir Shahriar Tamim, Md. Samiul Alim, Azmine Toushik Wasi +5Contrastive Language-Image Pre-Training ModelImagenet

  7. Multimodal Cultural Heritage Architectural Style Classification for Residential Buildings in the UAE Based on CLIP Embeddings and SVM

    Sep 15, 2026Ahmed Ammar Kubba, Manar Abu Talib, Iman Ibrahim +1Contrastive Language-Image Pre-Training ModelSupport Vector Machines

  8. TecoPrompt: Temporal-Conservative Prompt Learning for Vision-Language Models

    Sep 15, 2026Zeyi Shao, Haowen Hua, Jiaxin Zhang +3Multiple Prompt Learning FrameworksContrastive Language-Image Pre-Training Model

  9. FRPSS: Feature Rearrangement in Pre-Shape Space for Single-Image Generation

    Sep 15, 2026Yuexing Han, Haoxuan Zhang, Bing WangMulti-Reference Image GenerationSingle-Cell Foundation Models

  10. Bridging Vision Foundation Model Priors with CLIP for Spatial-aware Few-shot Anomaly Detection in Medical Images

    Sep 14, 2026Juzheng Miao, Yuchen Yuan, Cheng Chen +1Medical ImagesLesion

  11. Low-Rank Prompt Learning for Vision-Language Models with Fixed-Token Bases

    Sep 8, 2026Tanvir Muntakim Tonoy, Sajjad Ghiasvand, Mahnoosh Alizadeh +1Multiple Prompt Learning FrameworksContrastive Language-Image Pre-Training Model

  12. CrACK: Adversarial Attacks on Cross-Model Consistency in Collaborative Vision Foundation Models

    Sep 7, 2026Feifei Liu, Jintao Cheng, Chi Man Vong +1Adversarial ExamplesContrastive Language-Image Pre-Training Model

  13. Exploring the Potential of Contrastive Language-Image Pre-training for Multi-Source Remote Sensing Data

    Sep 3, 2026Xiangyang Miao, Kelu Yao, Yekai Huang +7Remote SensingContrastive Language-Image Pre-Training Model

  14. Failure-Informed Image Self-Augmentation for Multimodal Large Language Model Self-Improvement

    Aug 4, 2026Chunyang Jiang, Pingping Zhang, Yuzhi Zhao +9Multimodal Large Language ModelsContrastive Language-Image Pre-Training Model

  15. SAFE-Merge: Data-Free Continual Model Merging with General Knowledge Preservation

    Aug 2, 2026Zihuan Qiu, Zhiyang Liao, Chiyuan He +5Continual Model MergingReplay-Based Continual Learning

  16. Rethinking Expert Training for Model Merging with Prompt Learning

    Jul 27, 2026Christos Georgakilas, Aniello Panariello, Samir El Karrat Moreno +3Continual Model MergingContrastive Language-Image Pre-Training Model

  17. IJCB-AFMFR 2026: Competition on Adapting Foundation Models for Face Recognition Using Synthetic Training Data

    Jul 27, 2026Tahar Chettaoui, Guray Ozgur, Eduarda Caldeira +13Face Recognition ModelSynthetic Training Data

  18. AspectCLIP: Optimizing CLIP Representation Space via Aspect-Guided Consistency Regularization

    Jul 15, 2026Yiyang Yao, Shanglin Liu, Jianming Lv +4Contrastive Language-Image Pre-Training ModelRegularization

  19. Fine-grained CLIP fine-tuning with self-annotated region alignment

    Jul 15, 2026Chenyang Zhao, Wei Lin, Antoni B. Chan +1Contrastive Language-Image Pre-Training ModelFine-Grained Perception

  20. The Hyperspherical Geometry of CLIP Latent Space: A Semantic Mixture Model

    Jul 15, 2026Zijie Yu, Gaowen Liu, Ramana Rao Kompella +2Contrastive Language-Image Pre-Training ModelSpherical Latent Space

  21. GeoSEAN: Explainable Country-Level Image Geolocation for ASEAN Regions

    Jul 14, 2026Muhamad Syukron, Danish Rafie Ekaputra, Tintrim Dwi Ary WidhianingsihCross-View Geo-LocalizationGeogs-Slam

  22. Towards Robustness against Typographic Attack with Training-free Concept Localization

    Jul 2, 2026Bohan Liu, Wenqian Ye, Guangzhi Xiong +3Contrastive Language-Image Pre-Training ModelVision Transformer

  23. HyFL-CLIP: Hyperbolic Fine-Tuning of CLIP for Robust Long-Context Understanding

    Jul 1, 2026Ji Ha Jang, Hayeon Kim, Chulwon Lee +2Contrastive Language-Image Pre-Training ModelEfficient Long-Context Inference

  24. ReasonCLIP-58M: Visually Grounded Commonsense Reasoning Supervision for CLIP

    Jun 25, 2026Sicheng Zhang, Muzammal Naseer, Binzhu Xie +5Contrastive Language-Image Pre-Training ModelVisual Representations

  25. Universal Guideline-Driven Image Clustering via a Hybrid LLM Agent

    Jun 23, 2026Wenliang Zhong, Rob Barton, Lucas Goncalves +7Contrastive Language-Image Pre-Training ModelClustering

  26. Data Selection Through Iterative Self-Filtering for Vision-Language Settings

    Jun 22, 2026Andrei Liviu Nicolicioiu, Sarvjeet Singh Ghotra, Morgane M. Moss +1Contrastive Language-Image Pre-Training ModelVision-Language Foundation Models

  27. Concept-Constrained Prompt Learning for Few-Shot CLIP Adaptation

    Jun 21, 2026Na Sang, Ding Ma, Rui Sang +1Multiple Prompt Learning FrameworksContrastive Language-Image Pre-Training Model

  28. Beyond Native Success: Auditing Deployment-Interface Exposure of CLIP Backdoors

    Jun 16, 2026Kunlan Xiang, Haomiao Yang, Wenbo JiangContrastive Language-Image Pre-Training ModelPoisoning

  29. EPIG: Emotion-Based Prompting for Personalised Image Generation

    Jun 11, 2026Emna Othmen, Mohamed Yassine Landolsi, Lotfi Ben RomdhaneImage GenerationContrastive Language-Image Pre-Training Model

  30. VL-DINO: Leveraging CLIP Vision-Language Knowledge for Open-Vocabulary Object Detectio

    Jun 10, 2026Hao Zhang, Qinran Lin, Linqi Song +1Open-Vocabulary Object DetectionVision-Language Foundation Models

  31. STEDiff: Strengthening Text Embedding for Text-to-Image Alignment in Diffusion Model

    Jun 9, 2026Hailan Zhang, Haipeng Liu, Bo Fu +1Text-To-Image Diffusion ModelsImage-Text Alignment

  32. Training-Free Multi-Concept LoRA Composition with Prompt-Aware Weighting

    Jun 2, 2026Georgios Tsoumplekas, Stella Bounareli, Vasileios ArgyriouContrastive Language-Image Pre-Training ModelPersonalization

  33. Beyond False Stability: High-Noise Drift Gating for Test-Time Adversarial Defenses in Vision-Language Models

    Jun 2, 2026Hashmat Shadab Malik, Muzammal Naseer, Salman KhanAdversarial TrainingContrastive Language-Image Pre-Training Model

  34. Density-Aware Translation of Spurious Correlations in Zero-Shot VLMs

    Jun 1, 2026Afsaneh Hasanebrahimi, Hanxun Huang, Christopher Leckie +1Contrastive Language-Image Pre-Training ModelModality Gap

  35. Detect Before You Leap: Mirage Detection in Vision-Language Models

    May 29, 2026Md. Shaown Miah, S. M. Taiabul Haque, Syed Ishtiaque Ahmed +1Contrastive Language-Image Pre-Training ModelVisual Evidence

  36. How can embedding models bind concepts?

    May 29, 2026Arnas Uselis, Darina Koishigarina, Seong Joon OhCross-ModalContrastive Language-Image Pre-Training Model

  37. Improving CLIP Adaptation by Breaking Tail Alignment for Source-Free Cross-Domain Few-Shot Learning

    May 28, 2026Shuai Yi, Yixiong Zou, Yuhua Li +1Vision-Language Model AdaptationContrastive Language-Image Pre-Training Model

  38. Dual-Prompt CLIP with Hybrid Visual Encoders for Occluded Person Re-Identification

    May 19, 2026Zhangjian Ji, Shaotong Qiao, Kai Feng +1Re-IdentificationDiverse Occlusion-And-Revelation Scenarios

  39. PERL: Parameter Efficient Reasoning in CLIP Latent Space

    May 18, 2026Simone Carnemolla, Salvatore Calcagno, Daniela Giordano +2Vision-Language Model AdaptationContrastive Language-Image Pre-Training Model

  40. t-gems: text-guided exit modules for decreasing clip image encoder

    May 17, 2026Alberto Presta, Grzegorz Stefanski, Michal Byra +1Multimodal Deep LearningCross-Modal

  41. SHED: Style-Homogenized Embedding Alignment for Domain Generalization

    May 16, 2026Kai Gan, Tong WeiContrastive Language-Image Pre-Training ModelMultimodal Domain Generalization

  42. Sparse Autoencoders enable Robust and Interpretable Fine-tuning of CLIP models

    May 15, 2026Fabian Morelli, Arnas Uselis, Ankit Sonthalia +1Contrastive Language-Image Pre-Training ModelModel Fine-Tuning

  43. AGC: Adaptive Geodesic Correction for Adversarial Robustness on Vision-Language Models

    May 15, 2026Zhiwei Li, Jiacheng Xue, Weining Wang +4Contrastive Language-Image Pre-Training ModelData Augmentation

  44. ACE-LoRA: Adaptive Orthogonal Decoupling for Continual Image Editing

    May 14, 2026Yuehao Liu, Weijia Zhang, Xuanming Shang +4Image EditingReplay-Based Continual Learning

  45. CLIP Tricks You: Training-free Token Pruning for Efficient Pixel Grounding in Large VIsion-Language Models

    May 13, 2026Sangin Lee, Yukyung ChoiVisual Token PruningLong Visual-Token Sequences

  46. ML-CLIPSim: Multi-Layer CLIP Similarity for Machine-Oriented Image Quality

    May 10, 2026Feng Ding, Haisheng Fu, Jie Liang +3Image Quality AssessmentLearned Image Compression

  47. Language-Conditioned Visual Grounding with CLIP Multilingual

    May 9, 2026J. de Curtò, Mauro Liz, I. de ZarzàContrastive Language-Image Pre-Training ModelRecent Vision-Language Models

  48. Coarse-to-Fine: Progressive Image Compression for Semantically Hierarchical Classification

    May 8, 2026Jungwoo Kim, Jun-Hyuk Kim, Jong-Seok LeeLearned Image CompressionNeural Codecs

  49. Systematic Evaluation of Large Language Models for Post-Discharge Clinical Action Extraction

    May 7, 2026Shivali Dalmia, Ananya Mantravadi, Prasanna DesikanLarge Language Model PipelinesNatural Language Processing

  50. Memory-Efficient Continual Learning with CLIP Models

    May 5, 2026Ryan King, Gang Li, Bobak Mortazavi +1Contrastive Language-Image Pre-Training ModelReplay-Based Continual Learning

  51. One Single Hub Text Breaks CLIP: Identifying Vulnerabilities in Cross-Modal Encoders via Hubness

    Apr 30, 2026Hiroyuki Deguchi, Katsuki Chousa, Yusuke SakaiCross-ModalCaptions

  52. Leveraging Verifier-Based Reinforcement Learning in Image Editing

    Apr 30, 2026Hanzhong Guo, Jie Wu, Jie Liu +6Image EditingContrastive Language-Image Pre-Training Model

  53. Probing CLIP's Comprehension of 360-Degree Textual and Visual Semantics

    Apr 27, 2026Hai Wang, Xiaochen Yang, Mingzhi Dong +1Frozen Contrastive Language-Image Pre-Training Visual EncoderContrastive Language-Image Pre-Training Model