3D Visual Grounding

Momentum

3 papers in the last four weeks, down 25% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 36

All topics
CardsList
  1. Task-Adaptive Grounded 3D-Programmers Using 2D VLMs

    Oct 1, 2026Arman Raayatsanati, Sombit Dey, Anna-Maria Halacheva +33D Visual Grounding3D Scene Understanding

  2. Grounded Action Model: 3D Grounding as a Foundation for Robotics

    Sep 20, 2026Gehao Zhang, Weikai Huang, Shailesh Shailesh +33D Visual Grounding

  3. SeqAlign3DVG: A Sequence-Aligned Benchmark and Voxel Reasoning Framework for 3D Visual Grounding

    Aug 31, 2026Yi Zhang, Yi Wang, Yueting Wu +33D Visual GroundingVoxel

  4. Geometry-Grounded Unified 3D Perception for Autonomous Driving

    Aug 13, 2026Longfei Xu, Xiaohui Wang, Zehao Huang +43D PerceptionAutonomous Driving Perception

  5. ThinkAfford: Affordance-Centric Reasoning for Fine-Grained 3D Grounding in Cluttered Scenes

    Aug 11, 2026Xinrui Lin, Sha Zhang, Shumin Wang +33D Visual GroundingAffordances

  6. Embodied Multimodal Grounding for Open-Vocabulary Mobile Manipulation via Semantic 3D Gaussian Splatting

    Aug 11, 2026Huosen Ou, Dongni Song, Yuncong Wang +23D Visual GroundingReal-World Manipulation Tasks

  7. CoordRefer: Coordinate-Aware 3D Visual Grounding from Multiview Images

    Aug 6, 2026Haijie Li, Jiaxin Zhang, Dave Zhenyu Chen +33D Visual GroundingVision-Language Model Grounding

  8. Talk2Sensors: 3D Visual Grounding in Autonomous Driving via Sensor-Adaptive Physical Cue Matching

    Aug 5, 2026Runwei Guan, Di Tian, Ningwei Ouyang +93D Visual GroundingAutonomous Driving Perception

  9. TDVR: Joint Text Disambiguation and Viewpoint Reasoning for Zero-Shot 3D Visual Grounding

    Aug 4, 2026Qingxi Du, Junbo Wang, Yuke Li +13D Visual GroundingDisambiguation

  10. UniPhysGen: Unified Physical Grounding for Simulation-Ready 3D Assets

    Jul 15, 2026Xian Li, Rong Wei, Lujie Yang +63D AssetsPhysics Simulation

  11. More Than Where You Are: Learning Semantics, Structure, and Geometry from Cross-View Localization

    Jul 14, 2026Mao Chen, Xiangkai Zhang, Zhiyong Liu +2Cross-ViewSequential Visual Localization

  12. Ground3D-LMM: Fine-Grained 3D Point Grounding and Spatial Reasoning with LMM

    Jul 6, 2026Amol Harsh, Zongyan Han, Jean Lahoud +53D Visual Grounding3D Scene Understanding

  13. PruneGround: Plug-and-play Spatial Pruning for 3D Visual Grounding

    Jun 30, 2026Duc Cao Dinh, Khai Le-Duc, Florent Draye +43D Visual GroundingVision-Language Model Grounding

  14. Beyond 2D Matching: A Unified Single-Stage Framework for Geometry-Aware Cross-View Object Geo-Localization

    Jun 29, 2026Liyao Wang, Ruipu Wu, Haojun Xu +3Cross-View Geo-LocalizationCross-View

  15. Pseudo-Text-Conditioned 3D Grounding DINO for Organ Localization in Abdominal CT

    Jun 25, 2026Siqi Chen, Han Gong, Keyi Hou +3Cone-Beam Computed Tomography3D Visual Grounding

  16. Scaling Diverse Language Generation for 3D Visual Grounding

    Jun 18, 2026Austin T. Wang, Dongchen Yang, Angel X. Chang3D Visual GroundingWeak Visual Grounding

  17. ZeroDex: Zero-Shot Long-Horizon Dexterous Manipulation via Multi-View 3D-Grounded VLM Reasoning

    Jun 17, 2026Jisoo Kim, Sangwon Baik, Taeksoo Kim +43D Visual GroundingRgb-Depth Cameras

  18. C3VD-DEFCOL: A Deformable Colonoscopy Dataset with Time-Resolved 3D Ground Truth and Realistic Appearance

    Jun 5, 2026Ethan Luk, Mayank V. Golhar, Anthony Song +5ColonoscopyDeformable Cnn

  19. Grounded 3D-Aware Spatial Vision-Language Modeling

    May 28, 2026An-Chieh Cheng, Yang Fu, Yatai Ji +123D Visual GroundingSpatial Grounding

  20. SSR3D-LLM: Structured Spatial Reasoning via Latent Steps for Fine-Grained Grounding in Unified 3D-LLMs

    May 27, 2026Jiawei Li, Ziyi Liu, Weijie Shi +33D Visual Grounding3D Spatial Reasoning

  21. AgentGrounder: Zero-Shot 3D Visual Pointcloud Grounding using Multimodal Language Models

    May 25, 2026Cuong Huynh, Maxim Popov, Denis Gridusov +13D Visual Grounding3D Scene Understanding

  22. SceneAligner: 3D-Grounded Floorplan Localization in the Wild

    May 21, 2026Junhyeong Cho, Ruojin Cai, Hadar Averbuch-ElorFloor Plan GenerationIndoor Localization

  23. SceneGraphGrounder: Zero-Shot 3D Visual Grounding via Structured Scene Graph Matching

    May 20, 2026Xuefei Sun, Xujia Zhang, Brendan Crowe +23D Visual GroundingSpatial Reasoning

  24. ROAR-3D: Routing Arbitrary Views for High-Fidelity 3D Generation

    May 20, 2026Hanxiao Sun, Mingxin Yang, Shuhui Yang +5High-Fidelity 3D Generation3D Generation

  25. Interaction Locality in Hierarchical Recursive Reasoning

    May 20, 2026Yosuke Miyanishi, Tetsuro MorimuraSpatial Reasoning3D Visual Grounding

  26. Towards Camera-Robust 3D Localization: Equation-Anchored Tool-Use for MLLMs

    May 19, 2026Xueying Jiang, Wenhao Li, Quanhao Qian +43D Visual GroundingSequential Visual Localization

  27. Beyond Geometry: Efficient Topologically-Grounded Navigation in Complex 3D Environments

    May 17, 2026Yifan Du, Chengwei Zhang, Siyu Liao +13D Visual GroundingRobot Navigation

  28. Multiple Consistent 2D-3D Mappings for Robust Zero-Shot 3D Visual Grounding

    Apr 29, 2026Yufei Yin, Jie Zheng, Qianke Meng +73D Visual Grounding3D Scene Understanding

  29. GTASA: Ground Truth Annotations for Spatiotemporal Analysis, Evaluation and Training of Video Models

    Apr 12, 2026Nicolae Cudlenco, Mihai Masala, Marius LeordeanuVideo Temporal GroundingVideo Dataset

  30. OpenGround: Planning-based Online Perception for Open-World 3D Visual Grounding

    Dec 28, 2025Wenyuan Huang, Zhenyu Zhang, Zhao Wang +43D Visual GroundingOpen-World

  31. PanoGrounder: Bridging 2D and 3D with Panoramic Scene Representations for VLM-based 3D Visual Grounding

    Dec 24, 2025Seongmin Jung, Seongho Choi, Gunwoo Jeon +23D Visual GroundingRecent Vision-Language Models

  32. Error-Driven Scene Editing for 3D Grounding in Large Language Models

    Nov 18, 2025Yue Zhang, Zun Wang, Han Lin +53D Visual GroundingSpatial Grounding