Referring Video Object Segmentation

Latest papers 23

All topics
CardsList
  1. Event-Driven Refresh and Recurrence Memory to Reduce Stale Grounding in Referring Video Object Segmentation

    Sep 30, 2026Abu Hanif Muhammad Syarubany, Jaehyun Jang, Siwoo Lim +2Video Object SegmentationReferring Video Object Segmentation

  2. OPERA: A Unified Omnimodal Progressive Spatio-Temporal Reasoning Agent for Referring Video Segmentation

    Sep 27, 2026Jingchen Ni, Yuji Wang, Shannan Yan +3Unified Multimodal ModelsReferring Video Object Segmentation

  3. MoVISA: Multi-Token Reasoning for Video Object Segmentation

    Sep 24, 2026Ruining Zhao, Ho Kei Cheng, Alexander G SchwingVideo Object SegmentationReferring Video Object Segmentation

  4. Multi-Agent Target-Existence Verification and Learned Mask Geometry Refinement: Winning Report of the MeViS-Text Track at the 8th LSVOS Challenge 2026

    Aug 11, 2026Jungyoon Lee, Gyuil Lim, Doeon Kim +1Image SegmentationReferring Video Object Segmentation

  5. Agreement-Based Audio-Visual Segmentation:Champion Report for the MeViS-Audio Track in the 8th LSVOS Challenge

    Aug 10, 2026Yiwen Ren, Jianing Liu, Yingxin Wang +4Audio-Visual UnderstandingReferring Video Object Segmentation

  6. ReflexTrack: A Feedback-Driven Agent for Training-Free Referring Video Object Segmentation

    Jul 27, 2026Yuanjia Li, Tianyang Xu, Tao Zhou +3Video Object SegmentationReferring Video Object Segmentation

  7. Memory-Augmented Multimodal Large Language Models for Small Object Understanding in Streaming Aerial Videos

    Jul 22, 2026Penglei Sun, Yehua Huang, Zhuoli Tao +8Memory-Augmented VLMsAerial Robotics

  8. SkyVLaM: Multimodal Large Language Model for UAV Video Understanding in Remote Sensing

    Jul 19, 2026Kaiwen Jing, Ruixu Jia, Bingyao Li +3Referring Video Object SegmentationMultimodal Large Language Models

  9. Understanding From Human Perspective: A Multi-agent System for Interactive Egocentric Medical Image Segmentation

    Jul 19, 2026Rongjun Ge, Dongyang Wang, Heng Zhu +3Interactive Medical Image SegmentationReferring Video Object Segmentation

  10. Event-Aware Instructed Assistant for Referring Video Segmentation

    Jun 25, 2026Jinyu Liu, Henghui Ding, Shuting He +1Referring Video Object SegmentationMultimodal Large Language Models

  11. FeVOS: Foresight Expression Video Object Segmentation

    Jun 24, 2026Kehan Lan, Kaining Ying, Henghui DingVideo Object SegmentationReferring Video Object Segmentation

  12. Boosting Text-Driven Video Segmentation via Geometry-Aware Distillation

    Jun 23, 2026Tianyu Zhu, Yingping Liang, Hesong Li +1Video Object SegmentationReferring Video Object Segmentation

  13. VideoSEG-O3: A Multi-turn Reinforcement Learning Framework for Reasoning Video Object Segmentation

    Jun 5, 2026Ming Dai, Sen Yang, Boqiang Duan +4Video Object SegmentationReferring Video Object Segmentation

  14. SetCon: Towards Open-Ended Referring Segmentation via Set-Level Concept Prediction

    May 19, 2026Zhixiong Zhang, Yizhuo Li, Shuangrui Ding +6Image SegmentationReferring Video Object Segmentation

  15. See What I Mean: Aligning Vision and Language Representations for Video Fine-grained Object Understanding

    May 18, 2026Boyuan Sun, Bowen Yin, Yuanming Li +2Cross-Modal LearningVideo Object Segmentation

  16. Don't Guess, Just Ask: Resolving Ambiguity in Referring Segmentation via Multi-turn Clarification

    May 17, 2026Yuting Yang, Haichao Jiang, Tianming Liang +2Image SegmentationVideo Object Segmentation

  17. SteerSeg: Attention Steering for Reasoning Video Segmentation

    May 14, 2026Ali Cheraghian, Hamidreza Dastmalchi, Abdelwahed Khamis +3Video Object SegmentationReferring Video Object Segmentation

  18. Robust Promptable Video Object Segmentation

    May 12, 2026Sohyun Lee, Yeho Gwon, Lukas Hoyer +3Video Object SegmentationReferring Video Object Segmentation

  19. APRVOS: 1st Place Winner of 5th PVUW MeViS-Audio Track

    Apr 20, 2026Deshui Miao, Yameng Gu, Chao Yang +3Audio-Visual UnderstandingVideo Object Segmentation

  20. AgentRVOS for MeViS-Text Track of 5th PVUW Challenge: 3rd Method

    Apr 20, 2026Deshui Miao, Chao Yang, Chao Tian +4Image SegmentationVideo Object Segmentation

  21. Weakly-Supervised Referring Video Object Segmentation through Text Supervision

    Apr 20, 2026Miaojing Shi, Jun Huang, Zijie Yue +1Video Object SegmentationReferring Video Object Segmentation

  22. RefAM: Attention Magnets for Zero-Shot Referral Segmentation

    Sep 26, 2025Anna Kukleva, Enis Simsar, Alessio Tonioni +4Zero-Shot LearningImage Segmentation