Spatial Reasoning Benchmarks

Latest papers 83

All topics
CardsList
  1. SpatialQuery: Benchmarking Geometry-Grounded Multi-Instance Spatial Reasoning in Vision-Language Models

    Aug 3, 2026Hai Nguyen, Tung Vu, Cong TranSpatial Reasoning Benchmarks3D Spatial Reasoning

  2. JigShape: Evaluating Visual-Geometric Reasoning in VLMs through Jigsaw Puzzles

    Jul 30, 2026Shawn Li, Wei Yang, Jike Zhong +11VLM EvaluationSpatial Reasoning Benchmarks

  3. Visual Credit Audit for Multimodal Spatial Reasoning

    Jul 29, 2026Feixiang Liu, Qiang Qiu, Lanbo Sun +3VLM EvaluationSpatial Reasoning Benchmarks

  4. Spatial-IQ: Deconstructing Spatial Intelligence via Hierarchical Capability Tests

    Jul 24, 2026Patrick Rim, Tom Long, Ekta Prashnani +6Spatial Reasoning BenchmarksVisual Spatial Reasoning

  5. ViSTR-Bench: Can MLLMs Reason from Continuous Visual Cues in Dynamic Scenes?

    Jul 23, 2026Han Li, Si Liu, Zehao Huang +6VLM EvaluationSpatial Reasoning Benchmarks

  6. Do Maps Still Matter for Machines: Revisiting the Role of Choropleth Maps in Foundation Model Spatial Understanding

    Jul 20, 2026Zhiwei Wei, Yonghe Sun, Zhenjia Liu +5Data VisualizationSpatial Reasoning Benchmarks

  7. TerraLogic: A Benchmark for Hierarchical Geospatial Reasoning in Earth Observation

    Jul 14, 2026Yuhang Yan, Linchao Mou, Bokang Yang +1Spatial Reasoning BenchmarksHierarchical Planning

  8. IDEAL-Bench: Indoor Dataset and Evaluation suite for Analyzing 3D Layout reasoning

    Jul 3, 2026Yuening Cai, Junwei Zhou, Youran Qu +1VLM EvaluationSpatial Reasoning Benchmarks

  9. MindEdit-Bench: Benchmarking Object-Level Counterfactual Spatial Reasoning in VLMs from In-the-Wild Photos

    Jul 1, 2026Leyuan Yu, Xiao Tang, Minghao Liu +6VLM EvaluationSpatial Reasoning Benchmarks

  10. HumanMoveVQA: Can Video MLLMs reason about human movement in videos?

    Jun 26, 2026Pulkit Gera, Faegheh Sardari, Asmar Nadeem +4VLM EvaluationSpatial Reasoning Benchmarks

  11. From Hallucination to Grounding: Diagnosing Visual Spatial Intelligence via CRISP

    Jun 25, 2026Zhixing Li, Yinan YuVLM EvaluationSpatial Reasoning Benchmarks

  12. TriViewBench: Controlled Complexity Scaling for Multi-View Structural Reasoning in MLLMs

    Jun 24, 2026Yu-Yang Chen, Lan-Zhe GuoSpatial Reasoning BenchmarksVisual Reasoning

  13. MapReason-OSM: Can Vision-Language Models Make Graph-Verifiable Mobility Decisions from Street Maps ?

    Jun 21, 2026Srinivas Venkatanarayanan, Clement Pakkam IsaacVLM EvaluationSpatial Reasoning Benchmarks

  14. CVSBench: A Comprehensive Benchmark for Cross-view Spatial Reasoning and Dreaming

    Jun 21, 2026Ruixun Liu, Lingyu Zhang, Lanxuan Xue +3VLM EvaluationSpatial Reasoning Benchmarks

  15. Keep It in Mind: User Centric Continual Spatial Intelligence Reasoning in Egocentric Video Streams

    Jun 13, 2026Yun Wang, Junbin Xiao, Han Lyu +6Spatial Reasoning BenchmarksStreaming Video Understanding

  16. Embodied-BenchClaw: An Autonomous Multi-Agent System for Embodied Spatial Intelligence Benchmark Construction

    Jun 10, 2026Baoyang Jiang, Fengchun Zhang, Leyuan Wang +7Spatial Reasoning BenchmarksSynthetic Benchmark Generation

  17. SpatialWorld: Benchmarking Interactive Spatial Reasoning of Multimodal Agents in Real-World Tasks

    Jun 8, 2026Hongcheng Gao, Hailong Qu, Jingyi Tang +18Spatial Reasoning BenchmarksVisual Spatial Reasoning

  18. PlanBench-V: A Spatial Planning Map Benchmark for Vision-Language Models

    Jun 4, 2026Minxin Chen, He Zhu, Junyou Su +3VLM EvaluationSpatial Reasoning Benchmarks

  19. From Symbolic to Geometric: Enabling Spatial Reasoning in Large Language Models

    Jun 3, 2026Chen Chu, Bita Azarijoo, Li Xiong +2Spatial Reasoning BenchmarksMultimodal Large Language Models

  20. OVO-S-Bench: A Hierarchical Benchmark for Streaming Spatial Intelligence in Multimodal LLMs

    Jun 2, 2026Yifei Li, Pengyiang Liu, Yuhang Zang +4Spatial Reasoning BenchmarksSpatiotemporal Reasoning

  21. Eliciting Complex Spatial Reasoning in MLLMs through Wide-Baseline Matching

    Jun 2, 2026Hao Zhong, Muzhi Zhu, Shenyan Zeng +8VLM EvaluationSpatial Reasoning Benchmarks

  22. Consistent Yet Wrong: Evidence Insensitivity in Spatial Vision-Language Models

    Jun 1, 2026S Divakar Bhat, Toshihiko YamasakiVLM EvaluationMulti-View Consistency

  23. ERGeoBench:A Comprehensive Benchmark for Embodied Reasoning and Geo-localization in Multimodal Large Language Models

    May 29, 2026Kaiwen Xue, Tao Wei, Guoxin Zhang +5Spatial Reasoning BenchmarksVisual Spatial Reasoning

  24. SpatialAct: Probing Spatial Reasoning-to-Action Capabilities of VLM Agents in 3D Scenes

    May 29, 2026Tianhui Liu, Jie Feng, Zhiheng Zheng +6Spatial Reasoning BenchmarksVisual Spatial Reasoning

  25. Why Far Looks Up: Probing Spatial Representation in Vision-Language Models

    May 28, 2026Cheolhong Min, Jaeyun Jung, Daeun Lee +5VLM EvaluationSpatial Reasoning Benchmarks