Reasoning Segmentation

Momentum

3 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 19

All topics
CardsList
  1. OPERA: A Unified Omnimodal Progressive Spatio-Temporal Reasoning Agent for Referring Video Segmentation

    Sep 27, 2026Jingchen Ni, Yuji Wang, Shannan Yan +3Unified Multimodal ModelsReferring Video Object Segmentation

  2. GeoRefer-Bench: A Benchmark from Referring Pixels to Verifiable Geospatial Reasoning

    Aug 25, 2026Shuaishuai Cao, Min Huang, Meng Tang +3Spatial Reasoning BenchmarksGeospatial Reasoning

  3. DGSeg: Dynamic Gating of Semantic-Spatial Guided Predictions for Reasoning Segmentation

    Jul 6, 2026Ruizhe Zeng, Siyu Cao, Lu Zhang +1Text-Guided Image SegmentationVLM Reasoning

  4. STAC: Selective Spatiotemporal Aggregation and Compression for Video Reasoning Segmentation

    Jul 3, 2026Syed Ariff Syed Hesham, Yun Liu, Guolei Sun +4Video ReasoningReasoning Segmentation

  5. GEAR-Seg: A Grounded Explainable Agent for Reasoning Segmentation and Data Engine

    Jul 1, 2026Yanan Wang, Wen Li, Yibin Ying +1Text-Guided Image SegmentationVLM Reasoning

  6. Reason Twice: Segmentation via Candidate Discovery and Comparative Reasoning

    Jun 8, 2026Xinyan Gao, Haoran Hao, Xiangyu YueImage SegmentationText-Guided Image Segmentation

  7. VideoSEG-O3: A Multi-turn Reinforcement Learning Framework for Reasoning Video Object Segmentation

    Jun 5, 2026Ming Dai, Sen Yang, Boqiang Duan +4Video Object SegmentationReferring Video Object Segmentation

  8. CR-Seg: Attention-Guided and CoT-Enhanced Coarse-to-Refined Reasoning Segmentation

    Jun 2, 2026Yifan Cao, Xiaocui Yang, Faxian Wan +3Text-Guided Image SegmentationPromptable Image Segmentation

  9. FlowSeg: Dynamic Semantic Guidance for LLM-Conditioned Segmentation

    May 28, 2026Zekang Zhang, Guangyu Gao, Youyun Tang +7Text-Guided Image SegmentationReferring Image Segmentation

  10. ReasonOps: Operator Segmentation for LLM Reasoning Traces

    May 28, 2026Daniel Lee, Owen Queen, James ZouCoT EvaluationCoT Reasoning

  11. Can Segmentation Models Understand the World? Towards Proactive Affordance Reasoning via Visual Chain-of-Thought

    May 26, 2026Yuchen Guo, Junli Gong, Hongmin Cai +2Image SegmentationText-Guided Image Segmentation

  12. SegCompass: Exploring Interpretable Alignment with Sparse Autoencoders for Enhanced Reasoning Segmentation

    May 21, 2026Zhenyu Lu, Liupeng Li, Jinpeng Wang +4Image SegmentationText-Guided Image Segmentation

  13. SteerSeg: Attention Steering for Reasoning Video Segmentation

    May 14, 2026Ali Cheraghian, Hamidreza Dastmalchi, Abdelwahed Khamis +3Video Object SegmentationReferring Video Object Segmentation

  14. RCoT-Seg: Reinforced Chain-of-Thought for Video Reasoning and Segmentation

    May 8, 2026Junwei Wen, Deshui Miao, Guangming Lu +2Video Object SegmentationVideo Reasoning

  15. AnchorSeg: Language Grounded Query Banks for Reasoning Segmentation

    Apr 20, 2026Rui Qian, Chuanhang Deng, Qiang Huang +6Image SegmentationText-Guided Image Segmentation

  16. PixDLM: A Dual-Path Multimodal Language Model for UAV Reasoning Segmentation

    Apr 17, 2026Shuyan Ke, Yifan Mei, Changli Wu +4Image SegmentationRemote Sensing Image Segmentation

  17. MediRound: Multi-Round Entity-Level Reasoning Segmentation in Medical Images

    Nov 15, 2025Qinyue Tong, Ziqian Lu, Jun Liu +3Interactive Medical Image SegmentationText-Guided Image Segmentation