Multimodal Contrastive Learning

Latest papers 153

All topics
CardsList
  1. Multi-modal Video Representation Alignment for Robust Self-supervised Driver Distraction Detection

    Jun 1, 2026David J. Lerch, Livien Majer, Zeyun Zhong +3Multimodal RobustnessCross-Modal Alignment

  2. CL-DMDF:Dynamic Multimodal Data Fusion Model Based on Contrastive Learning

    Jun 1, 2026Dong Li, Lingling Zhang, Binghao Han +2Missing-Modality LearningCross-Modal Attention

  3. HOLA: Holistic Multi-Modal Alignment for Open-Set 3D Recognition

    May 31, 2026Koby Aharonov, Oren Shrout, Ayellet TalContrastive LearningOpen-Set Recognition

  4. OVA-IB: One vs All Information Bottleneck for Multi-Modal Alignment

    May 28, 2026Tianchao Li, Shujian Yu, Xinrui Zu +4Cross-Modal LearningCross-Modal Alignment

  5. COMET: Concept Space Dissection of the Modality Gap in Audio-Text Multimodal Contrastive Embeddings

    May 28, 2026Yonggang Zhu, Liting Gao, Aidong Men +1Audio UnderstandingAudio-Language Models

  6. TRACER: Persistent Regularization for Robust Multimodal Finetuning

    May 28, 2026Hesam Asadollahzadeh, Feng Liu, Christopher Leckie +1VLM RobustnessNeural Network Robustness

  7. Utility-Aware Multimodal Contrastive Learning for Product Image Generation

    May 27, 2026Xiaohang Feng, Yiling XieImage GenerationE-Commerce

  8. A Signal-Language Foundation Model for Broad-Spectrum Cardiovascular Assessment from Routine Electrocardiography

    May 25, 2026Ziqing Yu, Yuhui Tao, Jiayu Huo +19ElectrocardiographyElectrocardiogram Foundation Models

  9. Checking Fact with Better Retrieval: Dynamic Contrastive Learning for Evidence Retrieval

    May 24, 2026Zhongtian Hua, Yi Luo, Meijia Yu +1Automated Fact-CheckingCross-Modal Retrieval

  10. Cross-Modal Contrastive Learning of ECG and Angiography Representations for Severe Stenosis Classification

    May 23, 2026Nikola Cenikj, Özgün Turgut, Alexander Müller +5Medical ImagingCoronary Angiography

  11. MindAlign: Bridging EEG, Vision, and Language for Zero-Shot Visual Decoding

    May 23, 2026Zexuan Chen, Sichao Liu, Runhao Lu +4EEG-Based Visual DecodingCross-Modal Alignment

  12. SLIP-RS: Structured-Attribute Language-Image Pre-Training for Remote Sensing Object Detection

    May 22, 2026Chenxu Wang, Yuxuan Li, Yunheng Li +3Open-Vocabulary Object DetectionRemote Sensing Image Understanding

  13. Multimodal LLMs under Pairwise Modalities

    May 20, 2026Yan Li, Yunlong Deng, Yuewen Sun +3Cross-Modal LearningRepresentation Identifiability

  14. Cross-modal Affinity-aligned Multimodal Learning Analytics for Predicting Student Collaboration Satisfaction in Game-Based Learning

    May 16, 2026Wen-Hsin Tsai, Chia-Ming Lee, Yuk-Ying TungCross-Modal LearningMultimodal Robustness

  15. Semi-MedRef: Semi-Supervised Medical Referring Image Segmentation with Cross-Modal Alignment

    May 15, 2026Yuchen Li, Zhen Zhao, Yi Liu +1Interactive Medical Image SegmentationCross-Modal Alignment

  16. Your CLIP has 164 dimensions of noise: Exploring the embeddings covariance eigenspectrum of contrastively pretrained vision-language transformers

    May 14, 2026Jakub Grzywaczewski, Dawid Płudowski, Przemysław BiecekRepresentation GeometryRepresentation Learning

  17. Vision-Core Guided Contrastive Learning for Balanced Multi-modal Prognosis Prediction of Stroke

    May 14, 2026Liren Chen, Lidong Sun, Mingyan Huang +5Cross-Modal AlignmentClinical Outcome Prediction

  18. CA-GCL: Cross-Anatomy Global-Local Contrastive Learning for Robust 3D Medical Image Understanding

    May 13, 2026Hanwen Zhang, Yao Liu, Die Dai +4VLM RobustnessMedical Image Anomaly Detection

  19. SMA: Submodular Modality Aligner For Data Efficient Multimodal Learning

    May 13, 2026Truong Pham, Anay Majee, Rishabh IyerCross-Modal LearningCross-Modal Alignment

  20. Hystar: Hypernetwork-driven Style-adaptive Retrieval via Dynamic SVD Modulation

    May 11, 2026Yujia Cai, Boxuan Li, Chenghao Xu +1Multimodal IRVLM Adaptation

  21. CoLVR: Enhancing Exploratory Latent Visual Reasoning via Contrastive Optimization

    May 9, 2026Ziyang Ding, Linjian Meng, Yiming Wu +3Visual ReasoningLatent Visual Reasoning

  22. DINORANKCLIP: DINOv3 Distillation and Injection for Vision-Language Pretraining with High-Order Ranking Consistency

    May 7, 2026Shuyang Jiang, Nan Yu, Yiming Zhang +2Contrastive LearningVision-Language Alignment

  23. DART: A Vision-Language Foundation Model for Comprehensive Rope Condition Monitoring

    May 6, 2026Anju Rani, Daniel Ortiz-Arroyo, Petar DurdevicJoint-Embedding Predictive ArchitectureLarge Vision-Language Models

  24. Multi-Level Bidirectional Biomimetic Learning for EEG-Based Visual Decoding

    May 6, 2026Jingtao Liu, Peiliang Gong, Chuhang Zheng +2Visual Representation LearningEEG-Based Visual Decoding

  25. Ultrasound Vision-Language Alignment via Contrastive Learning

    May 4, 2026Zhuoyang Lyu, Yiyang Zhang, Tongxin Wang +1Cross-Modal AlignmentUltrasound Imaging

  26. EASE: Federated Multimodal Unlearning via Entanglement-Aware Anchor Closure

    May 1, 2026Zihao Ding, Beining Wu, Jun HuangCross-Modal LearningMultimodal Federated Learning

  27. Label-Conditioned Cross-Modal Fusion for Adult-to-Pediatric ECG Transfer via Curriculum-Gated Contrastive Alignment

    May 1, 2026Xinran Liu, Yuwen Li, Hongxiang Gao +4ElectrocardiographyCross-Modal Alignment