Spatial Reasoning Benchmarks

Latest papers 83

All topics
CardsList
  1. Mine Odyssey: Benchmarking Spatial Agentic Intelligence in the Wild

    Oct 8, 2026Yuxuan Cao, Junlong Li, Hao Li +1AI Agent BenchmarksSpatial Reasoning Benchmarks

  2. Relational Abstractions for Spatial Reasoning with Diffusion Models

    Oct 7, 2026Ana Ezquerro, Ozan ÖzdenizciSpatial ReasoningDiffusion Models

  3. Humanity's Sixth Sense: Benchmarking Intuitive Visual Reasoning in Multimodal Models

    Oct 6, 2026Xingang Guo, Jing Gu, Brian Jang +26Visual ReasoningMultimodal Model Evaluation

  4. SpatialChain: A Benchmark for Auditing Spatial Reasoning Faithfulness in VLMs

    Oct 5, 2026Rafael Teixeira Sousa, Vinícius Paulo Lopes de Oliveira, Elisa Ayumi Masasi de Oliveira +5VLM EvaluationSpatial Reasoning Benchmarks

  5. Agentic AI with Structured CoT for Enhancing AI's Spatial Intelligence: Visualization and Reasoning of Rotation

    Oct 3, 2026Uttamasha Monjoree, Wei YanSpatial Reasoning Benchmarks3D Spatial Reasoning

  6. From Reasoning Failures to Composable Video Spatial Intelligence

    Oct 1, 2026Pengzhan Sun, Junbin Xiao, Ramanathan Rajaraman +2Spatial Reasoning BenchmarksVideo Reasoning

  7. KilometerVision: A New Frontier for Large-Scale Spatial Intelligence in VLMs

    Sep 30, 2026Aravindh Mahendran, Michael King, Matthew Koichi Grimes +12Spatial Reasoning BenchmarksVisual Spatial Reasoning

  8. Uruqi: Learning Spatial Cognition from Visual Experience

    Sep 30, 2026Shichao Li, Meiqi Wang, Fei Su +1Spatial Reasoning BenchmarksVisual Spatial Reasoning

  9. VCN-Bench: A Video-Contextualized Navigation Benchmark for Spatial Reasoning over Prior Visual Experience

    Sep 28, 2026Siqi Zhang, Meng Wei, Chenyang Wan +6Visual NavigationSpatial Reasoning Benchmarks

  10. Beyond Spatial Benchmarks: From Spatial Reasoning to Navigation

    Sep 24, 2026Xun Huang, Shijia Zhao, Rongsheng Qu +5Spatial Reasoning BenchmarksRobot Policy Learning

  11. ReSTI: A Source-Grounded Audit and Repair of STI-Bench

    Sep 21, 2026Pengzhan Sun, Ramanathan Rajaraman, Shiu-Hong Kao +2Spatial Reasoning BenchmarksSpatiotemporal Reasoning

  12. Do LiDAR Language Models Really Understand Spatio-temporal Relationships?

    Sep 21, 2026Runyi Yang, Murat Akkoyun, Di Wen +8VLM EvaluationHallucination Detection in VLMs

  13. OmniEcho: Audio-Visual Spatial Understanding for Omni-Modal Embodied Agents

    Sep 20, 2026Ruixun Liu, Yuxuan Wang, Jiacheng Xie +10Audio-Visual UnderstandingSpatial Reasoning Benchmarks

  14. VABench: Measuring Embodied Spatial Intelligence through Visual Demonstrations, Active Perception, and Metric Control

    Sep 17, 2026Zhongbo Zhang, Jiayi Jin, Yifan Wang +4Active PerceptionSpatial Reasoning Benchmarks

  15. SceneBench: A Hierarchical Benchmark for Vision-Language Understanding of 3D Scenes

    Sep 14, 2026Anubhav Khanal, Prabigya Acharya, Roshni Poudel +5Spatial Reasoning Benchmarks3D Spatial Reasoning

  16. MindTopo: Can Foundation Models Reason in Topological Space?

    Sep 12, 2026Yunfei Ge, Anbang Liu, Qineng Wang +9Spatial Reasoning BenchmarksAI Agent Benchmarks

  17. MV-STRIDE: Enabling MLLMs to Master Multi-View Spatial Reasoning via Hierarchical Capability Modeling

    Sep 7, 2026Jin Xu, Xiaojian Huang, Zhuodong Luo +6Spatial Reasoning Benchmarks3D Spatial Reasoning

  18. Autoregressive Mosaics: Probing 2D Spatial Reasoning in Text-Only Language Models

    Aug 31, 2026Ashwin Nedungadi, Stefan Oehmcke, Stefan LüdtkeSpatial Reasoning Benchmarks

  19. Reactivating Test-Time Scaling for Plane Geometry Problem Solving

    Aug 31, 2026Xiaoqiang Kang, Shengen Wu, Maizhen Ning +5Spatial Reasoning BenchmarksInference-Time Scaling

  20. UrbanGround: From Local Perception to Spatial Agency in a Real-Scale City

    Aug 27, 2026Tianjie Ju, Zheng Wu, Yueqing Sun +15Spatial Reasoning BenchmarksRobot Navigation

  21. GeoRefer-Bench: A Benchmark from Referring Pixels to Verifiable Geospatial Reasoning

    Aug 25, 2026Shuaishuai Cao, Min Huang, Meng Tang +3Spatial Reasoning BenchmarksGeospatial Reasoning

  22. CausalSplat: Towards Comprehensive Hierarchical Reasoning in 3D Gaussian Splatting

    Aug 11, 2026Jiayu Ding, Meilu Song, Yun Chen +23D Gaussian SplattingSpatial Reasoning Benchmarks

  23. 360CityArena: A Realistic Virtual Urban Navigation Benchmark for Embodied Agents

    Aug 9, 2026Kenta Watanabe, Atsuyuki Miyai, Mizuki Takenawa +2Spatial Reasoning BenchmarksEmbodied Navigation

  24. GeoBenchLLM: A Comprehensive Benchmark for Evaluating LLMs on Geo-Related Tasks

    Aug 7, 2026Rodrigo Ferreira Rodrigues, Karim Radouane, Jose G Moreno +1Spatial Reasoning BenchmarksLLM Evaluation

  25. Geo-Spatial Concept Probing of Large Language Models: Abstraction, Compositionality, and Grounding

    Aug 7, 2026Karim Radouane, Jose G Moreno, Lynda TamineSpatial Reasoning BenchmarksLLM Grounding

  26. GST-Bench: Can VLMs Develop Global Spatial Awareness from Video?

    Aug 6, 2026Qifeng Zhang, Kaixiang Huang, Heng Dong +6VLM EvaluationSpatial Reasoning Benchmarks

  27. MultiGlobeQA: A Multilingual and Globally Diverse Benchmark for Geospatial Reasoning

    Aug 4, 2026Martin Böckling, Elizaveta Nosova, Heiko Paulheim +1Multilingual Language Model EvaluationSpatial Reasoning Benchmarks