3D Representation Learning

Latest papers 129

All topics
CardsList
  1. IVGT: Implicit Visual Geometry Transformer for Neural Scene Representation

    May 15, 2026Yuqi Wu, Tianyu Hu, Wenzhao Zheng +43D ViTsImplicit Neural Representations

  2. Discretizing Group-Convolutional Neural Networks for 3D Geometry in Feature Space

    May 14, 2026Daniel Franzen, Jean Philip Filling, Michael WandEquivariant Neural Networks3D Representation Learning

  3. Tadpole: Autoencoders as Foundation Models for 3D PDEs with Online Learning

    May 14, 2026Qiang Liu, Felix Koehler, Benjamin Holzschuh +13D Foundation ModelsPDE Surrogate Modeling

  4. Evo-Depth: A Lightweight Depth-Enhanced Vision-Language-Action Model

    May 14, 2026Tao Lin, Yuxin Du, Jiting Liu +14Language-Conditioned Robot ManipulationEfficient VLA Models

  5. H2G: Hierarchy-Aware Hyperbolic Grouping for 3D Scenes

    May 12, 2026ByungHa Ko, Youngmin Lee, Dong Hwan KimClusteringHierarchical Representation Learning

  6. Learning Protein Structure-Function Relationships through Knowledge-guided Representation Decomposition

    May 12, 2026Mingqing Wang, Zhiwei Nie, Athanasios V. Vasilakos +2Representation Disentanglement3D Representation Learning

  7. Beyond Spatial Compression: Interface-Centric Generative States for Open-World 3D Structure

    May 11, 2026Xiang Chen, Alexander Binder3D Asset Generation3D Spatial Reasoning

  8. SpaceMind++: Toward Allocentric Cognitive Maps for Spatially Grounded Video MLLMs

    May 10, 2026Bo Gu, Zhikang Zhang, Zizhuang Wei +33D Spatial ReasoningVLM Reasoning

  9. Proxy3D: Efficient 3D Representations for Vision-Language Models via Semantic Clustering and Alignment

    May 8, 2026Jerry Jiang, Haowen Sun, Denis Gudovskiy +43D Spatial Reasoning3D Representation Learning

  10. Text-to-CAD Retrieval: a Strong Baseline

    May 7, 2026Honghu Pan, Zibo Du, Daxiang Liu +2Cross-Modal Retrieval3D Representation Learning

  11. Velox: Learning Representations of 4D Geometry and Appearance

    May 6, 2026Anagh Malik, Dorian Chan, Xiaoming Zhao +3Representation LearningPoint Cloud Learning

  12. Representation learning from OCT images

    May 4, 2026Hedi Tabia, Désiré Sidibé, Nawres Khlifa +6Medical ImagingMedical Imaging Foundation Models

  13. PointCSP: Cross-Sample Semantic Propagation and Stability Preservation in Self-Supervised Point Cloud Learning

    May 3, 2026Xinxing Yu, Ajian Liu, Sunyuan Qiang +5Self-Supervised Pre-TrainingPoint Cloud Learning

  14. Adaptive Texture-aware Masking for Self-Supervised Learning in 3D Dental CBCT Analysis

    May 3, 2026Xinquan Yang, Jianfeng Ren, Xuguang Li +4Cone-Beam CTSelf-Supervised Pre-Training

  15. Beyond Gaussian Bottlenecks: Topologically Aligned Encoding of Vision-Transformer Feature Spaces

    Apr 30, 2026Andrew Bond, Ilkin Umut Melanlioglu, Erkut Erdem +1Variational AutoencodersHyperspherical Representation Learning

  16. SQuadGen: Generating Simple Quad Layouts via Chart Distance Fields

    Apr 30, 2026Youkang Kong, Yang Liu, Yue Dong +23D Mesh Generation3D Representation Learning

  17. Long-tail Internet photo reconstruction

    Apr 24, 2026Yuan Li, Yuanbo Xiangli, Hadar Averbuch-Elor +23D Foundation Models3D Reconstruction

  18. PASR: Pose-Aware 3D Shape Retrieval from Occluded Single Views

    Apr 24, 2026Jiaxin Shi, Guofeng Zhang, Wufei Ma +33D Representation Learning

  19. FILTR: Extracting Topological Features from Pretrained 3D Models

    Apr 24, 2026Louis Martinez, Maks OvsjanikovPoint Cloud Learning3D Representation Learning

  20. Structure-guided molecular design with contrastive 3D protein-ligand learning

    Apr 21, 2026Carles Navarro, Philipp Tholke, Gianni de FabritiisContrastive LearningVirtual Screening

  21. Diff-SBSR: Learning Multimodal Feature-Enhanced Diffusion Models for Zero-Shot Sketch-Based 3D Shape Retrieval

    Apr 21, 2026Hang Cheng, Fanhe Dong, Long Zeng3D Representation LearningT2I Diffusion Models

  22. PLAF: Pixel-wise Language-Aligned Feature Extraction for Efficient 3D Scene Understanding

    Apr 17, 2026Junjie Wen, Junlin He, Fei Ma +13D Scene Representation3D Representation Learning

  23. TORA: Topological Representation Alignment for 3D Shape Assembly

    Apr 5, 2026Nahyuk Lee, Zhiang Chen, Marc Pollefeys +1Flow Matching3D Shape Generation

  24. FusionBERT: Multi-View Image--3D Retrieval via Cross-Attention Visual Fusion and Normal-Aware 3D Encoder

    Apr 2, 2026Wei Li, Yufan Ren, Hanqing Jiang +6Multi-View LearningCross-Modal Retrieval

  25. RGB-Pointmap Pretraining for Unified 3D Scene Understanding

    Apr 2, 2026Ye Mao, Weixun Luo, Ranran Huang +23D Foundation ModelsMulti-View Learning

  26. Back to Point: Exploring Point-Language Models for Zero-Shot 3D Anomaly Detection

    Mar 23, 2026Kaiqiang Li, Gang Li, Mingle Zhou +3Point Cloud Anomaly DetectionIndustrial Inspection