Visual Representation Learning

Latest papers 147

All topics
CardsList
  1. GIFT: Guided Intermediate Feature Training via Action-Oriented Structural Supervision for Robotic Manipulation

    Sep 3, 2026Yupeng Zheng, Xiang Li, Songen Gu +11Visual Representation LearningWorld Models for Robotics

  2. Pix2Rep-v2: Data-Efficient Representation Learning for Dense Medical Imaging Applications

    Sep 1, 2026S. Sifaoui, E. Angelini, S. Toupin +2Representation LearningVisual Representation Learning

  3. On the Design Fundamentals of Pixel Text Representation Learning

    Sep 1, 2026Chaohao Yuan, Ruifeng Yuan, Zhuoxu Huang +4Visual Representation LearningVision-Language Alignment

  4. DINOcular: Self-Supervised Visuospatial Representations

    Aug 27, 2026Farkhat Almukhamedov, Sami Azirar, Hermann BlumVisual Representation LearningGeometric Representation Learning

  5. DDMS: Discriminative Distillation of Multi-view Foundational Features into Single-view Models

    Aug 24, 2026Jeong-gi Kwak, Sho Kagami, Yuki Ono +1Multi-View ConsistencyVisual Representation Learning

  6. Support Operation Factorization: Compositional Readout of Frozen Vision Encoders under Controlled Interventions

    Aug 6, 2026Zhongyao Wang, Wanli Ouyang, Taoyong Cui +1Visual Representation LearningRepresentation Disentanglement

  7. IRIS: A Visual Cortex-Inspired Framework for Analyzing Orientation Selectivity in Vision Transformers

    Aug 5, 2026Vaishnavi B Mohan, Vijayakrishna Naganoor, Yashas Annadani +1Transformer InterpretabilityVisual Representation Learning

  8. VaRS-Doc: Interpretation-Aware Variant Representations via Latent Self-Probing for Visual Document Retrieval

    Aug 2, 2026Haocheng Wang, Tongkun Guan, Wei Shen +1Visual Representation LearningLate Interaction Retrieval

  9. Foveated Probes Recover Localized Binding Information in Vision Foundation Models

    Aug 1, 2026Mateusz Michalkiewicz, Mahsa Baktashmotlagh, Guha BalakrishnanVisual Representation LearningVision Foundation Models

  10. Artificial Intelligence for the Characterization of Particles and Fibers by Optical Microscopy

    Aug 1, 2026Simiao Sun, Kenneth Ng, Lynn Lee +6Cross-Modal Knowledge DistillationVisual Representation Learning

  11. RayViT: Ray-Conditioned Visual Representations for Viewpoint-Robust Imitation Learning

    Jul 31, 2026Qian Wang, Longrui Chen, Peiran Sun +8Visual Representation LearningRobot Skill Learning

  12. Rethinking Pretraining for Specialized Design Data: Evidence from the JONES-19 Cultural Design Dataset

    Jul 31, 2026Alexandros Haridis, Charles ZhouVisual Representation Learning

  13. Logographic Character Visual Pretraining via Semantic-based Contrastive Learning

    Jul 30, 2026Daqian Shi, Wei Cao, Xiaoyu Zheng +3Contrastive LearningVisual Representation Learning

  14. Not All Patches are Equal: Sampling Matters for Visible-Infrared Pre-Training

    Jul 22, 2026Qiwei Ma, Bin Deng, Junjie Zhu +5Visual Representation LearningSelf-Supervised Pre-Training

  15. Spiking Neural Networks for fMRI-Based Visual Semantic Decoding

    Jul 21, 2026Jiahong Zhang, Jinning Zhao, Sijun Shen +3Visual Representation LearningNeural Decoding

  16. scMIR: a vision-language foundation model for single-cell light microscopy image representation

    Jul 21, 2026Yifan Shang, Jiahui Tan, Xiangxiang Zeng +1Cross-Modal Representation LearningVisual Representation Learning

  17. Norm or Direction? Decoding Vision Mambas for High-Resolution Vision

    Jul 21, 2026Jin Yu, Juyoun ParkVisual Representation LearningVisual SSMs

  18. Beyond Color Geometry: Evaluating Human-Like Color Representations in Vision Models

    Jul 15, 2026Ayan Igali, Pakizar ShamoiVisual Representation LearningFine-Grained Visual Perception

  19. TextileNet: Towards Zero-shot Text-style Segmentation of Manuscripts

    Jul 10, 2026Anguelos Nicolaou, Antonella Ambrosio, Desiree Di Donato +1Visual Representation LearningAuthorship Attribution

  20. Weaving Light and Time: Unified Harmonic-Geometric Representation Learning for Dense RGB-Event Parsing

    Jul 10, 2026Chenxu Peng, Chongtian zhou, Dicheng Liu +5Event-Based VisionVisual Representation Learning

  21. Vision Transformers Learn Gestalt-Like Figure-Ground Cues from Natural Images

    Jul 9, 2026Matthias Tangemann, Benjamin Lo, Zygmunt Pizlo +3Visual Representation LearningVision Transformer

  22. Texture Representations in Deep Vision Models: Comparing CNNs, Vision Transformers, and Human Perception

    Jul 9, 2026Ludovica de Paolis, Marco Baroni, Alessandro Laio +1Visual Representation LearningVision Transformer

  23. Unpaired Joint Distribution Modeling via Multi-Scale Image Representations

    Jul 9, 2026Yihang Zou, Hui Zhang, Zuowei Shen +1Visual Representation LearningUnsupervised Representation Learning

  24. VEIL: How Visual Encoding Hijacking Induces Bias In Vision Models

    Jul 6, 2026Suranjana Sooraj, Xuyang Chen, Madhumitha Venkatesan +1Scientific VisualizationData Visualization

  25. Geometry-aware Depth-guided Representation Learning for Structure-preserving Low-light Image Enhancement

    Jul 6, 2026Fang Gao, Jiongkai Qin, Jiabao Wang +5Image EnhancementVisual Representation Learning