Multimodal Contrastive Learning

Latest papers 153

All topics
CardsList
  1. Dynamic Alignment and Calibration for Multimodal Learning

    Oct 6, 2026Jinghao Xu, Zhenhua Guo, Xiaofeng Zhu +1Multimodal RobustnessCross-Modal Alignment

  2. MS-ECG-FM: Towards a More Universal Electrocardiogram Foundation Model for Health Monitoring using Multi-source Contrastive Learning

    Oct 6, 2026Robert A. Lewis, I-Min Chiu, Kyle Verrier +7Electrocardiogram Foundation ModelsElectrocardiogram Classification

  3. fMRI-TAMCL: Text-Anchored Supervised Multimodal Contrastive Learning for fMRI-Based Brain Disorder Classification

    Oct 5, 2026Juliana Mantebea Danso, Enoch Opanin Gyamfi, Mylene C. Q. FariasNeuroimagingMultimodal Contrastive Learning

  4. Cross-Modal Contrastive Learning for the Retrieval of Immunotherapy-Associated Molecular Signatures from Histopathology

    Oct 4, 2026Sigrid Vila-Bagaria, Mar Teixidó, Miquel Piñol +3Computational PathologyCross-Modal Retrieval

  5. Omni-Embed-Mini: Binding Modalities Without Forgetting via Dense Distillation

    Oct 1, 2026Mohammed Irfan Kurpath, Jaseel Muhammad Kaithakkodan, Sahal Shaji Mullappilly +2Cross-Modal Knowledge DistillationMultimodal Embedding

  6. End-to-End Self-Supervised RGB-T Tracking without Modality Misleading

    Sep 29, 2026Shenglan Li, Rui Yao, Kunyang Sun +4Multimodal RobustnessVisual Object Tracking

  7. Language as the Interface: Foundation-Model Contrastive Learning Links Transcriptomes and Electrophysiology

    Sep 29, 2026Junbo Shen, Jinying Gao, Bo LeiCross-Modal AlignmentMultimodal Foundation Models

  8. Structured Visual Target Learning For Cross-Subject eeg-to-image retrieval

    Sep 29, 2026Salini Yadav, Taveena Lotey, Mickaël Coustaty +2Cross-Subject EEG DecodingVisual Representation Learning

  9. SyncRA: Learning Temporal Correspondence in Omni-Modal Models

    Sep 28, 2026Zelong Xu, Yan Li, Wenhe Hu +1Audio-Visual Representation LearningAudio-Visual Synchronization

  10. Learning Multimodal Embeddings with Evidence-Aligned Readout

    Sep 27, 2026Zirong Chen, Fuda Ye, Enjun Du +8Multimodal Large Language ModelsMultimodal Embedding

  11. Cross-Modal Contrastive Learning from Histopathology and CT for Automated Renal Cell Carcinoma Grading

    Sep 22, 2026Amit Das, Tanmay Shukla, Naofumi Tomita +9Medical Image ClassificationOncology

  12. MMAP: Multimodal Missing-Aware Pretraining for Longitudinal Alzheimer's Prediction

    Sep 22, 2026Fiona Kekwick, Matthew Baugh, Bernhard Kainz +2Missing-Modality LearningCross-Modal Alignment

  13. RegRet: Enhancing Region-Level Retrieval in Large Multimodal Models

    Sep 15, 2026Xun Liang, Honghui Yang, Weihang Pan +6Multimodal IRMultimodal Large Language Models

  14. Anatomical Grounding and Leakage-Aware Multimodal Contrastive Learning for Alzheimer's Disease Classification from Structural MRI

    Sep 14, 2026Paul-Gabriel Nicolae, Irina Georgiana MocanuData LeakageAlzheimer's Disease Classification

  15. PACE: Progressive Angular-to-Norm Contrastive Embedding

    Sep 14, 2026Yanping Li, Wei Zhou, Yawen Liu +7Cross-Modal Representation LearningMultimodal Embedding

  16. Multimodal Floorplan Encoding: Learning Dense Modality-Invariant Representations

    Sep 14, 2026Xavier Anadón, Rémi Pautrat, Rui WangRepresentation LearningCross-Modal Representation Learning

  17. TeMo: Temperature Modulation for Multimodal Contrastive Learning

    Sep 7, 2026Dhimitrios Duka, Bernt Schiele, Hilde Kuehne +1Cross-Modal RetrievalMultimodal Classification

  18. Exploring the Potential of Contrastive Language-Image Pre-training for Multi-Source Remote Sensing Data

    Sep 3, 2026Xiangyang Miao, Kelu Yao, Yekai Huang +7Remote Sensing Image UnderstandingMultimodal Pretraining

  19. AlphaRAD: Grounded Zero-Shot Classification in Chest Radiology via αα-Corrected Binary Cross Entropy and Factorized Latent Supervision

    Sep 1, 2026Jianzhong You, Yuan Gao, Chris McIntoshChest X-Ray ClassificationMedical Image Classification

  20. Multimodal Shared Latent Representation of Narration, Microscope and iOCT Images for Phase Recognition in Vitreoretinal Surgery

    Aug 31, 2026Onur Izmitlioglu, Shervin Dehghani, Tarek Ghannoum +2Surgical Video UnderstandingMultimodal Contrastive Learning

  21. GAAT: Geometry-Aware Alignment Transformer for Multimodal UAV Perception

    Aug 28, 2026Jingpu Yang, Debin Tang, Yilin Sun +4Cross-Modal AlignmentMultimodal Pretraining

  22. Low-Interaction-Rank Learning: Unifying Multiplicative Dual-Encoder Heads

    Aug 12, 2026Zijian Zhao, Sen LiRepresentation IdentifiabilityMultimodal Contrastive Learning

  23. Rethinking Text-Based Image Retrieval in Specific Domain

    Aug 11, 2026Jingyang Tan, Sheng Yang, Yuanpeng Chen +4Image-Text RetrievalVision-Language Retrieval

  24. Perception Before Supervision: Self-Contained Visual Distillation from Counterfactual Blind Spots

    Aug 10, 2026Shravan Venkatraman, Omkar Thawakar, Ritesh Thawkar +2VLM DistillationLarge Vision-Language Models

  25. GeoUniPR: A Geometry-Consistent Unified Framework for Cross-Modal Place Recognition

    Aug 10, 2026Wonbong Kim, Jiatong Xiao, Rui Li +5Cross-Modal Representation LearningLiDAR Place Recognition