Geometric Cues

Momentum

1 paper in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 6Week of Sep 21

Latest papers 21

All topics
CardsList
  1. Imagine3D-LLM: Teaching MLLMs to Imagine 3D Scenes Before Answering

    Sep 29, 2026Jaewoo Jung, Hyeonseo Yu, Honggyu An +10Spatial ReasoningMultimodal Large Language Models

  2. GAPrompt++: Multi-Granular Geometry-Aware Point Cloud Prompt for 3D Vision Model

    Sep 17, 2026Zixiang Ai, Zhenyu Cui, Yufei Guo +4Point Clouds3D Geometry

  3. CANIS: Generation-Assisted 3D Canonicalization via an Image-Semantic Bridge

    Aug 7, 2026Kendong Liu, Yuxin Yao, Junhui Hou3D Generative ModelsGeometric Cues

  4. InsertFuse: A Unified Framework for Multi-Category Reference-Guided Image Insertion

    Aug 6, 2026Guangzhao Li, Qingyan Wei, Huayu Zheng +7Multi-Reference Image GenerationGeometric Cues

  5. When 2D Cues Fail: Improving Image Manipulation Localization with Reliable 3D Geometry

    Jul 20, 2026Guofeng Yu, Zhiqing Guo, Dan Ma +1Geometric Cues3D Geometry

  6. Vision Transformers Learn Gestalt-Like Figure-Ground Cues from Natural Images

    Jul 9, 2026Matthias Tangemann, Benjamin Lo, Zygmunt Pizlo +3Geometric CuesVisual Perception

  7. Geometric-Aware Hypergraph Reasoning for Novel Class Discovery in Point Cloud Segmentation

    Jun 5, 2026Zihao Zhang, Aming Wu, Yang Li +2Point CloudsGeometric Machine Learning

  8. Anchored, Not Graded: Vision-Language Models Fail at Slant-from-Texture Perception

    Jun 4, 2026Qian Zhang, Michal Golovanevsky, Fulvio Domini +1Geometric CuesPsychology

  9. Low-Magnification SEM May Suffice: Interpretable Deep Learning for Multi-Scale Fracture-Cause Classification in Zirconia-Toughened Alumina

    May 28, 2026Julian Schmid, Pawel Astankow, Tom Vater +3Electron MicroscopyDefect Detection

  10. ComPose: A Unified Completion-Pose Framework for Robust Category-Level Object Pose Estimation

    May 25, 2026Huan Ren, Yihan Chen, Chuxin Wang +3Category-Level Object Pose EstimationObject Geometry

  11. GA-VLN: Geometry-Aware BEV Representation for Efficient Vision-Language Navigation

    May 21, 2026Jiahao Yang, Zihan Wang, Xiangyang Li +4Vision-Language NavigationBird'S-Eye View

  12. Road Maps as Free Geometric Priors: Weather-Invariant Drone Geo-Localization with GeoFuse

    May 14, 2026Yunsong Fang, Tingyu Wang, Zhedong ZhengDrone-View Geo-LocalizationAerial Dataset

  13. 3DReflecNet: A Large-Scale Dataset for 3D Reconstruction of Reflective, Transparent, and Low-Texture Objects

    May 11, 2026Zhicheng Liang, Haoyi Yu, Boyan Li +6Large-Scale 3D Editing Dataset3D Reconstruction

  14. Learning Image-Adaptive Scale Fields for Metric Depth Recovery

    May 8, 2026Yuanyan Li, Matthias AlthoffMonocular Depth EstimationDense Prediction

  15. Where Do Vision-Language Models Fail? World Scale Analysis for Image Geolocalization

    Apr 17, 2026Siddhant Bharadwaj, Ashish Vashist, Fahimul Aleem +1Cross-View Geo-LocalizationSequential Visual Localization

  16. SENSE: Stereo OpEN Vocabulary SEmantic Segmentation

    Apr 17, 2026Thomas Campagnolo, Ezio Malis, Philippe Martinet +1Open-Vocabulary SegmentationSemantic Segmentation

  17. Towards Long-Form Spatio-Temporal Video Grounding

    Feb 26, 2026Xin Gu, Bing Fan, Jiali Yao +5Video Temporal GroundingSpatio-Temporal Attention

  18. StereoVLA: Enhancing Vision-Language-Action Models with Stereo Vision

    Dec 26, 2025Shengliang Deng, Mi Yan, Yixin Zheng +7Diffusion-Based Vision-Language-ActionsVision Encoders

  19. SIDA: Synthetic Image Driven Zero-shot Domain Adaptation

    Jul 24, 2025Ye-Chan Kim, SeungJu Cha, Si-Woo Kim +2Domain AdaptationPhotorealistic Style Transfer