3D Scene Understanding

Momentum

27 papers in the last four weeks, up 200% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 188

All topics
CardsList
  1. LetOccVote: Learning Weakly Supervised 3D Occupancy through Consensus

    Sep 4, 2026Chi Zhang, Qi Song, Feifei Li +23D Occupancy PredictionPseudo-Labeling

  2. Qwen-Drive-1.0: An Initial Step towards a Vision-Language Foundation Model for Autonomous Driving

    Aug 31, 2026Xin Zhou, Zongchuang Zhao, Zhibo Yang +13VLMs for Autonomous DrivingAutonomous Driving Perception

  3. Geometry-Grounded Unified 3D Perception for Autonomous Driving

    Aug 13, 2026Longfei Xu, Xiaohui Wang, Zehao Huang +4Depth EstimationAutonomous Driving Perception

  4. ThinkAfford: Affordance-Centric Reasoning for Fine-Grained 3D Grounding in Cluttered Scenes

    Aug 11, 2026Xinrui Lin, Sha Zhang, Shumin Wang +33D Scene Understanding3D VLMs

  5. LEGO: Leveled Language Gaussian Splatting

    Aug 10, 2026Yuning Peng, Haiping Wang, Yuan Liu +33D Gaussian SplattingVisual Spatial Reasoning

  6. RoboSeg: Online Part-Level Semantic Reconstruction for Robotic Manipulation via a Single Eye-in-Hand Camera

    Aug 10, 2026Zhaochen Lan, Mengxiang LinRobotic Grasping3D Part Segmentation

  7. RayLift: Lifting Complementary Ray-Wise Evidence with 3D Geometry Priors for Semantic Scene Completion

    Aug 9, 2026Meng Wang, Hongxia Yu, Wenzhe He +43D Semantic Segmentation3D Scene Completion

  8. Rethinking 3D Segmentation from Individual LiDAR Scans: Incidence-Aware Sampling on the SIP Benchmark

    Aug 7, 2026Seongyong Kim, Jingdao Chen, Yong Kwon Cho3D Point Cloud Segmentation3D Semantic Segmentation

  9. CANIS: Generation-Assisted 3D Canonicalization via an Image-Semantic Bridge

    Aug 7, 2026Kendong Liu, Yuxin Yao, Junhui Hou3D Scene Understanding

  10. InstanceSplat: Instance-Aware Feed-Forward 3D Gaussian Splatting for Scene Understanding

    Aug 7, 2026Minchao Jiang, Xiaoxuan Ma, Shunyu Jia +33D Gaussian SplattingOpen-Vocabulary 3D Segmentation

  11. UQ-Loc: Uncertainty-Aware LiDAR Scene Coordinate Regression

    Aug 6, 2026Jacek KomorowskiUncertainty QuantificationLiDAR Localization

  12. SmartMage: Dynamic Modality Orchestration for 3D Scene Understanding

    Aug 5, 2026Yue Zhang, Yingzhao Jian, Yunqiu Xu +2Mixture of ExpertsMultimodal Large Language Models

  13. Disentangling 3D Modeling from Spatial Reasoning

    Aug 5, 2026Haoze Sun, Jiequan Cui, Qingshan Xu +13D Spatial Reasoning3D Scene Understanding

  14. HiSC: Hierarchical Spatial Clustering Token Compression for Efficient 3D Scene Understanding

    Aug 5, 2026Jiuhe Qu, Yingping Liang, Ying Fu3D Spatial ReasoningVisual Token Pruning

  15. OutLangSplat: 3D Language Gaussian Splatting for UAV Outdoor Scenes

    Aug 5, 2026Xia Yan, He Wu, Yanghui Xu +23D Gaussian SplattingLanguage-Embedded 3DGS

  16. Geospatial-Prior Guidance for 3D Semantic Scene Completion

    Aug 4, 2026Meng Wang, Shougao Zhang, Wenzhe He +43D Occupancy Prediction3D Shape Completion

  17. PolyLayout: Multi-room Manhattan Layout Estimation

    Aug 4, 2026Gustav Hanning, Shaohui Liu, Rémi Pautrat +33D Scene Understanding

  18. Qwen-3D: A Generalist 3D Vision-Language Model for Spatial Understanding

    Aug 4, 2026Lucy Lin, Ayush Jain, Yifan Liu +13D Foundation Models3D VQA

  19. Assistant Placement Aria: A Benchmark for Egocentric Placement Assistance

    Aug 1, 2026Amir Belder, Gonçalo Dias Pais, Refael Vivanti +5Robot Manipulation Benchmarks3D Scene Understanding

  20. Distill What RGB Can Recover: Privileged 3D Evidence for RGB-Only Vision-Language Models

    Jul 31, 2026Yanbin Hu, Jin Cui, Jun Ye +43D Spatial ReasoningVLM Distillation

  21. MonoVoc: Decoupling Geometry and Semantics for Lightweight Monocular Open-Vocabulary 3D Gaussians

    Jul 30, 2026Pouya Ardekhani, Zahra Dehghanian, Morteza Abolghasemi +13D Gaussian SplattingOpen-Vocabulary 3D Segmentation

  22. SpatialQ: Understanding 3D Gaussian Splatting Scene Quality via Visual-based MLLM

    Jul 29, 2026Jingxuan Su, Shenglin Wang, Tiesong Zhao +23D Gaussian Splatting3D Scene Understanding

  23. SceneActBench: Can Agents Act on the 3D Scenes They See?

    Jul 24, 2026Yifei Zhao, Xiangxin Zhou, Wenhao Yang +11AI Agent BenchmarksTool-Using Vision-Language Agents

  24. Unified Video Dense Prediction from Disjoint Data

    Jul 23, 2026Yihong Sun, Seoung Wug Oh, Jiahui Huang +2Multi-Task LearningDense Prediction

  25. Scene Parameter Saliency via Differentiable Light Transport

    Jul 23, 2026Linas Beresna, Eugene FiumeGradient-Based Attribution3D Scene Understanding