Multimodal Contrastive Learning

Latest papers 153

All topics
CardsList
  1. Unsupervised Data-Efficient Cross-Modal Retrieval with Global-Neighborhood Alignment Hashing

    Jun 30, 2026Runhao Li, Xiaoxu Ma, Zhenyu Weng +5Cross-Modal AlignmentCross-Modal Retrieval

  2. Data-Efficient Multimodal Alignment for Histopathology-based Molecular Prediction

    Jun 29, 2026Dominik Winter, Dominik Vonficht, Loïc Le Bescond +6Computational PathologyCross-Modal Alignment

  3. SonoCLIP: Mask-Guided Region-Aware Vision-Language Pretraining for Fetal Ultrasound Analysis

    Jun 28, 2026Hang Su, Chao Sun, Zhaofan Li +3Medical Imaging Foundation ModelsUltrasound Imaging

  4. Rank-Aware Hyperbolic Alignment for Vision-Language Dataset Distillation

    Jun 28, 2026Jongoh Jeong, Sun-Kyung Lee, Kuk-Jin YoonDataset DistillationVision-Language Alignment

  5. Learning from Acquisition: Metadata-driven Multimodal Pre-training for Cardiac MRI

    Jun 27, 2026Xueyi Fu, Liwei Hu, Zi Wang +1Medical Image SegmentationMultimodal Contrastive Learning

  6. Text as Illumination: Spatial Contrastive Retinex Learning for Language-guided Medical Image Segmentation

    Jun 26, 2026Jian Shi, Cheng Zhen, Pingping Zhang +6Text-Guided Image SegmentationMedical Image Segmentation

  7. DFM: Difference Feature Modeling with Text-Guided Gated Contrastive Loss for Remote Sensing Image Change Captioning

    Jun 25, 2026Yelin Wang, Zijia Song, Chuanguang Yang +4Remote Sensing Image UnderstandingRemote Sensing Image Change Captioning

  8. Jolia: Concept-Level Vision-Language Alignment for 3D CT Contrastive Learning

    Jun 23, 2026Julien Khlaut, Charles Corbière, Baptiste Callard +93D Foundation ModelsMedical Imaging Foundation Models

  9. Mind the Heads: Topological Representation Alignment for Multimodal LLMs

    Jun 22, 2026Davide Caffagni, Alberto Compagnoni, Federico Melis +5Cross-Modal AlignmentMultimodal Large Language Models

  10. MAPS: Multi-Anchor Projection Similarity for Joint Vision-Language Geo-Localization

    Jun 21, 2026Yutong Hu, Siyuan Tan, Shaocheng Yan +3Cross-View Geo-LocalizationGeometric Representation Learning

  11. MultiMem: Measuring and Mitigating Memorization in Multi-Modal Contrastive Learning

    Jun 20, 2026Wenhao Wang, Franziska Boenisch, Michael Backes +1Multimodal Contrastive Learning

  12. Beyond Flat Labels: Level-Restricted Contrastive Learning for Hierarchical Fine-Grained Vision Classification

    Jun 20, 2026Zhiyuan Tao, Srikumar Sastry, Matthew J Thompson +9Hierarchical ClassificationContrastive Learning

  13. Multi-Modal Contrastive Learning for Implicit Earth Embeddings via Location Tying

    Jun 18, 2026Jonathan Hecht, Lukas Arzoumanidis, Ziyue Li +1Self-Supervised Pre-TrainingGeospatial Representation Learning

  14. Exploring Multi-Modal Large Language Models and Two-Stage Fine-Tuning for Fashion Image Retrieval

    Jun 18, 2026Nguyen Cao Hoang, Hoang Bui Le, Nam Vo Hoang +1Multimodal Large Language ModelsImage-Text Retrieval

  15. REVEAL++: Differentiable Phenotypic Grouping for Vision-Language Retinal Modeling of Alzheimer's Disease Risk

    Jun 17, 2026Ethan Elio Meidinger, Seowung Leem, Zeyun Zhao +1Contrastive LearningMedical Image Analysis

  16. TactSpace: Learning a Physics-enriched Shared Latent Space for Tactile Sim-to-Real Transfer

    Jun 17, 2026Arunim Joarder, Arjun Bhardwaj, René Zurbrügg +6Cross-Modal Representation LearningTactile Sensing

  17. Contextualizing Biological Language Models across Modalities via Logit-Space Contrastive Alignment

    Jun 17, 2026Yanjun Shao, Yundi Chen, Yashvi Patel +2Contrastive LearningProtein Language Models

  18. SUP-MCRL: Subject-aware Unified Pseudo-feature Coded Multimodal Contrastive Representation Learning for EEG Visual Decoding

    Jun 15, 2026Shengyu Gong, Weiming Zeng, Yueyang Li +4Cross-Subject EEG DecodingContrastive Learning

  19. CAP: Towards PPG Universal Representation Learning with Patient-level Supervision

    Jun 13, 2026Chenyang He, Xinyi Shao, Shun Huang +4Representation LearningCross-Modal Representation Learning

  20. Trimodal Glioma Representation Alignment via Volumetric Contrastive Learning

    Jun 12, 2026Denise Marini, Eleonora Grassucci, Danilo ComminielloCancer Survival PredictionCross-Modal Alignment

  21. LaME: Learning to Think in Latent Space for Multimodal Embedding via Information Bottleneck

    Jun 11, 2026Peixi Wu, Biao Yang, Feipeng Ma +7Efficient Multimodal InferenceMultimodal Embedding

  22. Objects Before Words: Object-First Inductive Biases for Grounding Language in Child-View Video

    Jun 11, 2026Sathira Silva, Abrham Kahsay Gebreselasie, Muhammad Umer Sheikh +3Object-Centric Representation LearningEgocentric Video Understanding

  23. RespiraMFM: A Multimodal Foundation Model with Contrastive Audio-Language Alignment for Respiratory Disease Identification

    Jun 8, 2026Shakhrul Iman Siam, Tiantian Feng, Jiankun Zhang +2HealthcareAudio-Language Models

  24. A robust PPG foundation model using multimodal physiological supervision

    Jun 5, 2026Eloy Geenjaar, Vince Calhoun, Scott Daly +4Multimodal RobustnessMultimodal Pretraining

  25. FIGMA: Towards FIne-Grained Music retrievAl

    Jun 4, 2026Nishit Anand, Ashish Seth, Sreyan Ghosh +2Audio UnderstandingAudio-Text Retrieval

  26. BRepCLIP: Contrastive Multimodal Pretraining on BRep Primitives for CAD Understanding

    Jun 3, 2026Muhammad Usama, Didier Stricker, Mohammad Sadil Khan +1Multimodal PretrainingMultimodal Contrastive Learning

  27. Continual Visual and Verbal Learning Through a Child's Egocentric Input

    Jun 3, 2026Xiaoyang Jiang, Yanlai Yang, Kenneth A. Norman +2Egocentric Video UnderstandingReplay-Based Continual Learning

  28. CP-Agent: Context-Aware Multimodal Reasoning for Cellular Morphological Profiling under Chemical Perturbations

    Jun 2, 2026Yuxin Zhang, Yiyao Li, Ping Shu Ho +3AI Agents for Scientific DiscoveryMultimodal Contrastive Learning