Cross-Modal Representation Learning

Momentum

14 papers in the last four weeks, up 100% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 136

All topics
CardsList
  1. TriTS: Time Series Forecasting from a Multimodal Perspective

    Apr 17, 2026Xiang AoLong-Term Time Series ForecastingCross-Modal Representation Learning

  2. MMGait: Towards Multi-Modal Gait Recognition

    Apr 17, 2026Chenye Wang, Qingyuan Cai, Saihui Hou +2Cross-Modal Representation LearningGait Analysis

  3. Robust Multispectral Semantic Segmentation under Missing or Full Modalities via Structured Latent Projection

    Apr 17, 2026Irem Ulku, Erdem Akagündüz, Ömer Özgür TanrıöverMissing-Modality LearningRemote Sensing Image Segmentation

  4. NOUS: Video-Driven 3D Human Reaction Generation via Observation-Reaction Mutual Steering

    Mar 20, 2026Yuan Zhou, Luanyuan Dai, Yongzhi Li +7Cross-Modal Representation LearningHuman Motion Generation

  5. SpectralGCD: Spectral Concept Selection and Cross-modal Representation Learning for Generalized Category Discovery

    Feb 19, 2026Lorenzo Caselli, Marco Mistretta, Simone Magistri +1Cross-Modal LearningCross-Modal Representation Learning

  6. Semantic Purification for Conditional Representation Learning

    Feb 5, 2026Jiaquan Wang, Yan Lyu, Chen Li +1Disentangled Representation LearningRepresentation Learning

  7. Superman: Unifying Skeleton and Vision for Human Motion Perception and Generation

    Feb 2, 2026Xinshun Wang, Peiming Li, Ziyi Wang +5Cross-Modal Representation LearningUnified Multimodal Models

  8. Cross-Modal Visuo-Tactile Representation Learning with Action Chunking Transformers for Contact-Rich Manipulation

    Jan 31, 2026Yaohua Liu, Rong Fu, Amir H. Gandomi +2Representation LearningCross-Modal Representation Learning

  9. Inverse-LLaVA: Rethinking Multimodal Alignment via Text-to-Vision Mapping

    Aug 17, 2025Xuhui Zhan, Tyler DerrCross-Modal LearningCross-Modal Representation Learning

  10. Platonic Representations for Poverty Mapping: Unified Vision-Language Codes or Agent-Induced Novelty?

    Aug 1, 2025Satiyabooshan Murugaboopathy, Connor T. Jerzak, Adel DaoudCross-Modal Representation LearningMultimodal Learning

  11. Multimodal Representation Alignment for Cross-modal Information Retrieval

    Jun 10, 2025Fan Xu, Luis A. LeivaCross-Modal LearningMultimodal IR

  12. A quantitative analysis of semantic information in deep representations of text and images

    May 21, 2025Santiago Acevedo, Andrea Mascaretti, Riccardo Rende +3Representational Similarity AnalysisCross-Modal Representation Learning

  13. Early Intervention for VFM-based Multimodal Medical Image Classification

    Date pendingQijie Wei, Hailan Lin, Xirong LiCross-Modal Representation LearningVision Foundation Model Adaptation