Cross-Modal Retrieval

Latest papers 134

All topics
CardsList
  1. GOMA: Toward Structure-Driven Multimodal Alignment from a Graph Signal Smoothing Perspective

    May 15, 2026Xu Wang, Xunkai Li, Yinlin Zhu +2Cross-Modal LearningMultimodal IR

  2. Differentially Private Motif-Preserving Multi-modal Hashing

    May 14, 2026Zehua Cheng, Wei Dai, Jiahao SunCross-Modal LearningCross-Modal Retrieval

  3. Neural Visual Decoding via Cognitive guided Adaptive Blurring and Information Constrained Alignment

    May 14, 2026Fan Yin, Chuhang Zheng, Peiliang Gong +2EEG-Based Visual DecodingCross-Modal Alignment

  4. Logit-Attention Divergence: Mitigating Position Bias in Multi-Image Retrieval via Attention-Guided Calibration

    May 12, 2026Mingtao Xian, Yifeng Yang, Qinying Gu +2Multimodal Large Language ModelsCross-Modal Retrieval

  5. MAG-VLAQ: Multi-modal Aerial-Ground Query Aggregation for Cross-View Place Recognition

    May 10, 2026Zhengyi Xu, Yuhang Ming, Zhihao Zhan +3Cross-View Geo-LocalizationVisual Place Recognition

  6. Revisiting Uncertainty: On Evidential Learning for Partially Relevant Video Retrieval

    May 7, 2026Jun Li, Peifeng Lai, Xuhang Lou +5Cross-Modal LearningEvidential Deep Learning

  7. Text-to-CAD Retrieval: a Strong Baseline

    May 7, 2026Honghu Pan, Zibo Du, Daxiang Liu +2Cross-Modal Retrieval3D Representation Learning

  8. ICPR 2026 Competition on Privacy-Preserving Person Re-Identification from Top-View RGB-Depth Camera (TVRID)

    May 6, 2026Raphaël Delécluse, Hazem Wannous, Laurent GuimasCross-Modal RetrievalPerson Re-Identification

  9. ReasonAudio: A Benchmark for Evaluating Reasoning Beyond Matching in Text-Audio Retrieval

    May 5, 2026Honglei Zhang, Yuting Chen, Chenpeng Hu +2Audio ReasoningAudio Understanding

  10. Interactive Multi-Turn Retrieval for Health Videos

    May 2, 2026Chengzheng Wu, Ke Qiu, Baoming Zhang +3HealthcareCross-Modal Retrieval

  11. Multimodal Data Curation Through Ranked Retrieval

    May 1, 2026Pratyush Muthukumar, Harshil Kotamreddy, Sarah Amiraslani +4Cross-Modal LearningCross-Modal Alignment

  12. Linking spatial biology and clinical histology via Haiku

    Apr 30, 2026Yan Cui, Jacob S. Leiby, Wenhui Lei +6Computational PathologyHealthcare

  13. One Single Hub Text Breaks CLIP: Identifying Vulnerabilities in Cross-Modal Encoders via Hubness

    Apr 30, 2026Hiroyuki Deguchi, Katsuki Chousa, Yusuke SakaiCross-Modal LearningMultimodal Robustness

  14. AnalogRetriever: Learning Cross-Modal Representations for Analog Circuit Retrieval

    Apr 25, 2026Yihan Wang, Lei Li, Yao Lai +2Cross-Modal Representation LearningElectronic Design Automation

  15. Federated Cross-Modal Retrieval with Missing Modalities via Semantic Routing and Adapter Personalization

    Apr 24, 2026Hefeng Zhou, Xuan Liu, Sicheng Chen +7Cross-Modal LearningMultimodal Federated Learning

  16. Beyond Chain-of-Thought: Rewrite as a Universal Interface for Generative Multimodal Embeddings

    Apr 24, 2026Peixi Wu, Ke Mei, Feipeng Ma +15Cross-Modal AlignmentMultimodal Embedding

  17. MiMIC: Mitigating Visual Modality Collapse in Universal Multimodal Retrieval While Avoiding Semantic Misalignment

    Apr 23, 2026Juan Li, Chuanghao Ding, Xujie Zhang +1Cross-Modal LearningCross-Modal Alignment

  18. Fast-then-Fine: A Two-Stage Framework with Multi-Granular Representation for Cross-Modal Retrieval in Remote Sensing

    Apr 22, 2026Xi Chen, Xu Chen, Xiangyang Jia +3Representation LearningCross-Modal Alignment

  19. UniCVR: From Alignment to Reranking for Unified Zero-Shot Composed Visual Retrieval

    Apr 22, 2026Haokun Wen, Xuemeng Song, Haoyu Zhang +3Cross-Modal LearningLearning to Rank

  20. Brain-Inspired Capture: Evidence-Driven Neuromimetic Perceptual Simulation for Visual Decoding

    Apr 20, 2026Feixue Shao, Guangze Shi, Xueyu Liu +6Representation LearningBrain-Computer Interfaces

  21. ReTrack: Evidence-Driven Dual-Stream Directional Anchor Calibration Network for Composed Video Retrieval

    Apr 20, 2026Zixu Li, Yupeng Hu, Zhiwei Chen +4Cross-Modal LearningCross-Modal Representation Learning

  22. Bidirectional Small-Granularity Search between Code and Text

    Apr 19, 2026Marco A. Valenzuela-Escárcega, Enrique Noriega-Atala, Gus Hahn-Powell +2AI-Assisted Scientific ResearchCross-Modal Retrieval

  23. LFRAG: Layout-oriented Fine-grained Retrieval-Augmented Generation on Multimodal Document Understanding

    Apr 18, 2026Yifan Zhu, Yu Mi, Yue Lu +2Multimodal RAGLate Interaction Retrieval