Multimodal Contrastive Learning

Latest papers 153

All topics
CardsList
  1. Linking spatial biology and clinical histology via Haiku

    Apr 30, 2026Yan Cui, Jacob S. Leiby, Wenhui Lei +6Computational PathologyHealthcare

  2. Learning Generalizable Multimodal Representations for Software Vulnerability Detection

    Apr 28, 2026Zeming Dong, Yuejun Guo, Qiang Hu +5Representation LearningSoftware Vulnerability Detection

  3. Contrastive Image-Metadata Pre-Training for Materials Transmission Electron Microscopy

    Apr 27, 2026Georgia Channing, Debora Keller, Marta D. Rossell +3Cross-Modal AlignmentMultimodal Contrastive Learning

  4. CLLAP: Contrastive Learning-based LiDAR-Augmented Pretraining for Enhanced Radar-Camera Fusion

    Apr 27, 2026Bingyi Liu, Chuanhui Zhu, Hongfei Xue +5Camera-Radar FusionSelf-Supervised Pre-Training

  5. Multi-View Synergistic Learning with Vision-Language Adaption for Low-Resource Biomedical Image Classification

    Apr 27, 2026Xiaoliu Luo, Minxue Xiao, Ting Xie +5VLM AdaptationMulti-View Learning

  6. Contrastive Learning for Multimodal Human Activity Recognition with Limited Labeled Data

    Apr 25, 2026Long Jing, Zhixiong Yang, Yajun Zhang +1Cross-Modal Representation LearningHuman Activity Recognition

  7. CGC: Compositional Grounded Contrast for Fine-Grained Multi-Image Understanding

    Apr 24, 2026Lihao Zheng, Zhenwei Shao, Yu Zhou +5Multimodal GroundingMultimodal Large Language Models

  8. REVEAL: Multimodal Vision-Language Alignment of Retinal Morphometry and Clinical Risks for Incident AD and Dementia Prediction

    Apr 20, 2026Seowung Leem, Lin Gu, Chenyu You +2Alzheimer's DiseaseMedical Imaging

  9. Can LLM-Generated Text Empower Surgical Vision-Language Pre-training?

    Apr 20, 2026Chengan Che, Chao Wang, Jiayuan Huang +2Surgical Video UnderstandingMedical VLMs

  10. Better with Less: Tackling Heterogeneous Multi-Modal Image Joint Pretraining via Conditioned and Degraded Masked Autoencoder

    Apr 18, 2026Bowen Peng, Yongxiang Liu, Jie Zhou +4Cross-Modal LearningMasked Autoencoders

  11. UniCon: Unified Framework for Efficient Contrastive Alignment via Kernels

    Apr 17, 2026Hangke Sui, Yuqing Wang, Minh N DoContrastive LearningCross-Modal Alignment

  12. Aligning Backchannel and Dialogue Context Representations via Contrastive LLM Fine-Tuning

    Apr 17, 2026Livia Qian, Gabriel SkantzeSpeech Language ModelsMultimodal Contrastive Learning

  13. Joint-Centric Dual Contrastive Alignment with Structure-Preserving and Information-Balanced Regularization

    Apr 17, 2026Habibeh Naderi, Behrouz Haji Soleimani, Stan MatwinCross-Modal LearningModality Imbalance

  14. Crab: Multi Layer Contrastive Supervision to Improve Speech Emotion Recognition Under Both Acted and Natural Speech Condition

    Mar 24, 2026Lucas H. Ueda, João G. T. Lima, Paula D. P. CostaContrastive LearningMultimodal Emotion Recognition

  15. WikiCLIP: An Efficient Contrastive Baseline for Open-domain Visual Entity Recognition

    Mar 10, 2026Shan Ning, Longtian Qiu, Jiaxuan Sun +1Vision-Language AlignmentMultimodal Contrastive Learning

  16. ITO: Multi-View Alignment and Training-Time Fusion for Image-Text Pretraining

    Mar 3, 2026Hanpeng Liu, Zidan Wang, Shuoxi Zhang +6Cross-Modal LearningCross-Modal Alignment

  17. Re-purposing Multimodal Large Language Models for Audio-Text Retrieval

    Feb 20, 2026Jilan Xu, Carl Thomé, Danijela Horak +2Multimodal Large Language ModelsAudio Understanding

  18. Enhancing IMU-Based Online Handwriting Recognition via Contrastive Learning with Zero Inference Overhead

    Feb 4, 2026Jindong Li, Dario Zanca, Vincent Christlein +4Contrastive LearningOnline Handwriting Recognition

  19. Cross-Modal Visuo-Tactile Representation Learning with Action Chunking Transformers for Contact-Rich Manipulation

    Jan 31, 2026Yaohua Liu, Rong Fu, Amir H. Gandomi +2Representation LearningCross-Modal Representation Learning

  20. The Geometric Mechanics of Contrastive Representation Learning: Alignment Potentials, Entropic Dispersion, and Cross-modal Divergence

    Jan 27, 2026Yichao Cai, Zhen Zhang, Yuhang Liu +1Cross-Modal LearningContrastive Learning

  21. CLIMP: Contrastive Language-Image Mamba Pretraining

    Jan 11, 2026Nimrod Shabtay, Itamar Zimerman, Eli Schwartz +1Cross-Modal LearningVLM Robustness

  22. Together, Then Apart: Balancing Alignment and Distinctiveness for Multimodal Survival Analysis

    Nov 22, 2025Wenjing Liu, Qin Ren, Wen Zhang +2Cancer Survival PredictionSurvival Analysis

  23. Revisiting Audio-language Pretraining for Learning General-purpose Audio Representation

    Nov 20, 2025Wei-Cheng Tseng, Xuanru Zhou, Mingyue Huo +3Audio-Language Model EvaluationAudio Representation Learning

  24. Contrastive vision-language learning with paraphrasing and negation

    Nov 20, 2025Kwun Ho Ngan, Saman Sadeghi Afgeh, Joe Townsend +1VLM RobustnessVLM Reasoning

  25. Theoretical Refinement of CLIP by Utilizing Linear Structure of Optimal Similarity

    Oct 17, 2025Naoki Yoshida, Satoshi Hayakawa, Yuhta Takida +3Cross-Modal LearningKernel Mean Embeddings

  26. Multimodal Representation Alignment for Cross-modal Information Retrieval

    Jun 10, 2025Fan Xu, Luis A. LeivaCross-Modal LearningMultimodal IR