Visual Representation Learning

Latest papers 147

All topics
CardsList
  1. Geometry-Supervised Visual Representation Learning for Multi-Phenotype Lesion Interpretation in Medical VLMs

    Oct 7, 2026Hao Wang, Qiwei Zeng, Shuchang Ye +5Visual Representation LearningMedical Image Representation Learning

  2. Beyond Local Linearity: Scale-Resolved Geometry of Learned Image Encoders

    Sep 30, 2026Jakub Szymkowiak, Wojtek Pałubicki, Kamil AdamczewskiNeural Representation GeometryVisual Representation Learning

  3. Function-Space Transformer with Adaptive Anchors

    Sep 29, 2026Guorui Sang, Pedram RooshenasRepresentation LearningVisual Representation Learning

  4. OmniTaskonomy: When Does Visual Generation Improve Visual Understanding?

    Sep 29, 2026Jiaxin Ge, Yiming Qin, Ji Xie +13Image-to-Image TranslationVisual Representation Learning

  5. V-JEPA Policy: Building Effective World-Action Models on Predictive Visual Latents

    Sep 29, 2026Yang Zhang, Jiangyuan Zhao, Chenyou Fan +4Visual Representation LearningVisuomotor Policy Learning

  6. Structured Visual Target Learning For Cross-Subject eeg-to-image retrieval

    Sep 29, 2026Salini Yadav, Taveena Lotey, Mickaël Coustaty +2Cross-Subject EEG DecodingVisual Representation Learning

  7. Early Learning Shapes Later Directions Of Representation Change In Continual Learning

    Sep 28, 2026Yuantao Deng, Jinnuo Liu, Kaizhen Tan +1Neural Representation GeometryVisual Representation Learning

  8. Learning Transferable Reaction Mechanisms from Visual Chemical Knowledge

    Sep 27, 2026Yujian Yuan, Jiaxin Xu, Xin Cai +4Visual Representation LearningTransfer Learning

  9. VisionHOPE: Visual Backbones as Self-Modifying Learning Systems

    Sep 27, 2026Siran Peng, Tianshuo Zhang, Tianyu Fu +8Visual Representation Learning

  10. IronViT: Toward Efficient Generalist Visual Representation Learning

    Sep 24, 2026Jiaxi Huang, Yueqi Hu, Xin Zhu +13Visual Representation LearningEfficient ViTs

  11. Learning Holographic Reduced Representations with Clifford Variational Autoencoders

    Sep 23, 2026Mohamed Malek Abid, P. Michael FurlongVariational AutoencodersVisual Representation Learning

  12. Geometry-Conditioned Visual Place Recognition in Natural Environments

    Sep 23, 2026Walter Nedov, Saimunur Rahman, Kavindie Katuwandeniya +3Visual Representation LearningVisual Place Recognition

  13. Canonical locks that encode part-whole hierarchies

    Sep 22, 2026Rajat Modi, Yogesh Singh RawatVisual Representation LearningHierarchical Representation Learning

  14. The Visual Target Matters: Learning across the Visual Hierarchy for Brain-to-Image Retrieval

    Sep 21, 2026Ye Wang, Haokun Ren, Hong Yu +4Visual Representation LearningEEG-Based Visual Decoding

  15. Rethinking Vision Architectures with Gated Linear Attention and KAN

    Sep 18, 2026Ali Mehizel, Oussama KhaldiVisual Representation LearningVision Transformer

  16. Training-Adaptive Convolutional Sparse Coding via Information Bottleneck for Robust Visual Representation

    Sep 16, 2026Meng'en Qin, Yinchen Liu, Mingxuan Cui +1Representation LearningTest-Time Adaptation

  17. Transformation Laws in Neural Representations: Structure, Realisability, and Construction

    Sep 16, 2026Yuan SunNeural Representation GeometryVisual Representation Learning

  18. InfoTaxa: Information-Calibrated Label-Free Clustering for Fine-Grained Visual Taxonomy

    Sep 15, 2026David Ahmedt-Aristizabal, Mohammad Ali Armin, Lars PeterssonVisual Representation LearningClustering

  19. Same Encoder, Different Winner: A Paired-View Framework for Cell Painting Encoder Evaluation

    Sep 14, 2026Tim Treis, Nikita Moshkov, Johan Fredin Haslum +2Visual Representation Learning

  20. HiPerViT: A Hierarchical Perceiver-Vision Transformer Architecture for Multi-Scale Texture Recognition

    Sep 11, 2026João Pedro C. A. de Sá, Odemir Martinez BrunoVisual Representation LearningVision Transformer

  21. GIFT: Guided Intermediate Feature Training via Action-Oriented Structural Supervision for Robotic Manipulation

    Sep 3, 2026Yupeng Zheng, Xiang Li, Songen Gu +11Visual Representation LearningWorld Models for Robotics

  22. Pix2Rep-v2: Data-Efficient Representation Learning for Dense Medical Imaging Applications

    Sep 1, 2026S. Sifaoui, E. Angelini, S. Toupin +2Representation LearningVisual Representation Learning

  23. On the Design Fundamentals of Pixel Text Representation Learning

    Sep 1, 2026Chaohao Yuan, Ruifeng Yuan, Zhuoxu Huang +4Visual Representation LearningVision-Language Alignment

  24. DINOcular: Self-Supervised Visuospatial Representations

    Aug 27, 2026Farkhat Almukhamedov, Sami Azirar, Hermann BlumVisual Representation LearningGeometric Representation Learning

  25. DDMS: Discriminative Distillation of Multi-view Foundational Features into Single-view Models

    Aug 24, 2026Jeong-gi Kwak, Sho Kagami, Yuki Ono +1Multi-View ConsistencyVisual Representation Learning

  26. Support Operation Factorization: Compositional Readout of Frozen Vision Encoders under Controlled Interventions

    Aug 6, 2026Zhongyao Wang, Wanli Ouyang, Taoyong Cui +1Visual Representation LearningRepresentation Disentanglement

  27. IRIS: A Visual Cortex-Inspired Framework for Analyzing Orientation Selectivity in Vision Transformers

    Aug 5, 2026Vaishnavi B Mohan, Vijayakrishna Naganoor, Yashas Annadani +1Transformer InterpretabilityVisual Representation Learning

  28. VaRS-Doc: Interpretation-Aware Variant Representations via Latent Self-Probing for Visual Document Retrieval

    Aug 2, 2026Haocheng Wang, Tongkun Guan, Wei Shen +1Visual Representation LearningLate Interaction Retrieval

  29. Foveated Probes Recover Localized Binding Information in Vision Foundation Models

    Aug 1, 2026Mateusz Michalkiewicz, Mahsa Baktashmotlagh, Guha BalakrishnanVisual Representation LearningVision Foundation Models

  30. Artificial Intelligence for the Characterization of Particles and Fibers by Optical Microscopy

    Aug 1, 2026Simiao Sun, Kenneth Ng, Lynn Lee +6Cross-Modal Knowledge DistillationVisual Representation Learning

  31. RayViT: Ray-Conditioned Visual Representations for Viewpoint-Robust Imitation Learning

    Jul 31, 2026Qian Wang, Longrui Chen, Peiran Sun +8Visual Representation LearningRobot Skill Learning

  32. Rethinking Pretraining for Specialized Design Data: Evidence from the JONES-19 Cultural Design Dataset

    Jul 31, 2026Alexandros Haridis, Charles ZhouVisual Representation Learning

  33. Logographic Character Visual Pretraining via Semantic-based Contrastive Learning

    Jul 30, 2026Daqian Shi, Wei Cao, Xiaoyu Zheng +3Contrastive LearningVisual Representation Learning

  34. Not All Patches are Equal: Sampling Matters for Visible-Infrared Pre-Training

    Jul 22, 2026Qiwei Ma, Bin Deng, Junjie Zhu +5Visual Representation LearningSelf-Supervised Pre-Training

  35. Spiking Neural Networks for fMRI-Based Visual Semantic Decoding

    Jul 21, 2026Jiahong Zhang, Jinning Zhao, Sijun Shen +3Visual Representation LearningNeural Decoding

  36. scMIR: a vision-language foundation model for single-cell light microscopy image representation

    Jul 21, 2026Yifan Shang, Jiahui Tan, Xiangxiang Zeng +1Cross-Modal Representation LearningVisual Representation Learning

  37. Norm or Direction? Decoding Vision Mambas for High-Resolution Vision

    Jul 21, 2026Jin Yu, Juyoun ParkVisual Representation LearningVisual SSMs

  38. Beyond Color Geometry: Evaluating Human-Like Color Representations in Vision Models

    Jul 15, 2026Ayan Igali, Pakizar ShamoiVisual Representation LearningFine-Grained Visual Perception

  39. TextileNet: Towards Zero-shot Text-style Segmentation of Manuscripts

    Jul 10, 2026Anguelos Nicolaou, Antonella Ambrosio, Desiree Di Donato +1Visual Representation LearningAuthorship Attribution

  40. Weaving Light and Time: Unified Harmonic-Geometric Representation Learning for Dense RGB-Event Parsing

    Jul 10, 2026Chenxu Peng, Chongtian zhou, Dicheng Liu +5Event-Based VisionVisual Representation Learning

  41. Vision Transformers Learn Gestalt-Like Figure-Ground Cues from Natural Images

    Jul 9, 2026Matthias Tangemann, Benjamin Lo, Zygmunt Pizlo +3Visual Representation LearningVision Transformer

  42. Texture Representations in Deep Vision Models: Comparing CNNs, Vision Transformers, and Human Perception

    Jul 9, 2026Ludovica de Paolis, Marco Baroni, Alessandro Laio +1Visual Representation LearningVision Transformer

  43. Unpaired Joint Distribution Modeling via Multi-Scale Image Representations

    Jul 9, 2026Yihang Zou, Hui Zhang, Zuowei Shen +1Visual Representation LearningUnsupervised Representation Learning

  44. VEIL: How Visual Encoding Hijacking Induces Bias In Vision Models

    Jul 6, 2026Suranjana Sooraj, Xuyang Chen, Madhumitha Venkatesan +1Scientific VisualizationData Visualization

  45. Geometry-aware Depth-guided Representation Learning for Structure-preserving Low-light Image Enhancement

    Jul 6, 2026Fang Gao, Jiongkai Qin, Jiabao Wang +5Image EnhancementVisual Representation Learning