Video Object Segmentation

Latest papers 81

All topics
CardsList
  1. FiVOS: A Fish Segmentation Algorithm Based on Interactive Video Object Segmentation and Filter Enhancement

    Oct 1, 2026Yuqing Duan, Song Zhang, Shili Zhao +2Video Object SegmentationFish

  2. iSEE: Object Permanence Through Self-Supervision

    Oct 1, 2026Pramish Paudel, Ajad Chhatkuli, Luc Van Gool +1Object-Centric RepresentationsVideo Object Segmentation

  3. Towards Automatic Video Annotation with ASH: Zero-Shot Open-Vocabulary Multi-Object Tracking and Segmentation

    Oct 1, 2026Arash Rocky, Q. M. Jonathan WuVideo Object SegmentationMulti-Object Tracking

  4. Seeing as Humans Do: Learning from Motion to Segment Anything Without Supervision

    Sep 30, 2026Weijian Jian, Xiaoyue Zhang, Bin Xiao +5Video Object SegmentationPhotometric Supervision

  5. Event-Driven Refresh and Recurrence Memory to Reduce Stale Grounding in Referring Video Object Segmentation

    Sep 30, 2026Abu Hanif Muhammad Syarubany, Jaehyun Jang, Siwoo Lim +2Video Object SegmentationObjects

  6. Learning to Reason with Persistent Object States for Video Instance Segmentation

    Sep 28, 2026Yongxue Xu, Boxue Yang, Ziqian Liu +3Video Object SegmentationPersistent State

  7. LVMT: Video Mask Transformer for Long-term Video Segmentation

    Sep 28, 2026Narges Norouzi, Niccolò Cavagnero, Idil Esen Zulfikar +3Video Object SegmentationMask2Former

  8. OPERA: A Unified Omnimodal Progressive Spatio-Temporal Reasoning Agent for Referring Video Segmentation

    Sep 27, 2026Jingchen Ni, Yuji Wang, Shannan Yan +3Video Object SegmentationMulti-Modal Data

  9. Less is More: Encoder-only Audio-Visual Segmentation

    Sep 24, 2026Ilpo Viertola, Vladimir Iashin, Sophie Tötterström +1Video Object SegmentationVision Encoders

  10. MoVISA: Multi-Token Reasoning for Video Object Segmentation

    Sep 24, 2026Ruining Zhao, Ho Kei Cheng, Alexander G SchwingVideo Object SegmentationMultimodal Large Language Models

  11. VOS-Agent: The 1st Place Solution for the 8th LSVOS Challenge (MOSEv2 Track)

    Aug 13, 2026Canyang Wu, Jinrong Zhang, Xusheng He +3Video Object SegmentationNeural Mask Estimation

  12. Distractor-Aware Video Object Segmentation

    Aug 12, 2026Andreas Robinson, Abdelrahman Eldesokey, Michael FelsbergVideo Object SegmentationDistractor

  13. Multi-Agent Target-Existence Verification and Learned Mask Geometry Refinement: Winning Report of the MeViS-Text Track at the 8th LSVOS Challenge 2026

    Aug 11, 2026Jungyoon Lee, Gyuil Lim, Doeon Kim +1Video Object SegmentationNeural Mask Estimation

  14. VIDS-Seg: Towards Reliable Uncertainty Quantification in Pediatric Cardiac Ultrasound Segmentation

    Aug 11, 2026Paul Fischer, Ece OzkanEchocardiographyLeft-Ventricular Ejection Fraction

  15. Agreement-Based Audio-Visual Segmentation:Champion Report for the MeViS-Audio Track in the 8th LSVOS Challenge

    Aug 10, 2026Yiwen Ren, Jianing Liu, Yingxin Wang +4Video Object SegmentationFine-Grained Video Understanding

  16. Depth-Guided Video Object Counting in Crowded Scenes

    Aug 6, 2026Yuanjing Xu, Xinyan Liu, Weidong Chen +5Video Object SegmentationRgb-Depth Cameras

  17. Hear to See: Discerning Stateful Listening for Audio-Visual Instance Segmentation

    Aug 4, 2026Leiye Liu, Miao Zhang, Jiahong Jiang +7Video Object SegmentationAudio-Visual Consistency

  18. QueenVIS: Rethinking Image-Only Training for Video Instance Segmentation via Query Enrichment

    Jul 27, 2026Arian Kheirandish, Fardin Ayar, Ehsan Javanmardi +2Video Object SegmentationLong Videos

  19. ReflexTrack: A Feedback-Driven Agent for Training-Free Referring Video Object Segmentation

    Jul 27, 2026Yuanjia Li, Tianyang Xu, Tao Zhou +3Video Object SegmentationSpatial Grounding

  20. SkyVLaM: Multimodal Large Language Model for UAV Video Understanding in Remote Sensing

    Jul 19, 2026Kaiwen Jing, Ruixu Jia, Bingyao Li +3Video Object SegmentationDrone Detection

  21. Still image and spatial-temporal tomato data enabling detection, segmentation, tracking, and video-instance segmentation using strong and weak labels

    Jul 16, 2026Michael Halstead, Esra Guclu, Mohamed Farag +7Tomato DiseasesFruit

  22. Active Learning for Efficient Annotation of Surgical Videos with Weak Supervision

    Jul 14, 2026Manasa Dendukuri, Matjaz Jogan, Daniel A. Hashimoto +1Surgical VideosVideo Object Segmentation

  23. REMIND: RE-Identification with Memory for INDoor Navigation

    Jul 10, 2026Pablo Diaz-Pereda, Alejandro Rodriguez-Ramos, David Perez-Saura +1Multi-Object TrackingRe-Identification

  24. SAM-MT: Real-Time Interactive Multi-Target Video Segmentation

    Jul 9, 2026Ruiqi Shen, Chang Liu, Henghui DingVideo Object SegmentationSegment Anything Model

  25. UAV-OVVIS: Unmanned Aerial Vehicles Also Need Open-Vocabulary Video Instance Segmentation

    Jul 9, 2026Mingyu Dou, Shi Qiu, Ming Hu +2Drone DetectionVideo Object Segmentation

  26. `Attention-Guided Cross-Temporal Clustering for Self-Supervised Video Object Segmentation

    Jul 8, 2026Waqas Arshid, Mohammad Awrangjeb, Alan Wee-Chung Liew +1Video Object SegmentationSelf-Supervised Learning

  27. G2^2TAM: Geometry Grounded Track Anything Model

    Jul 4, 2026Chenming Zhu, Peizhou Cao, Jingli Lin +5Video Object SegmentationSpatial Reasoning

  28. TrajLoc: Trajectory-Attention Localization for Multi-Object Motion Control

    Jul 1, 2026Omer Sela, Inbar Huberman-Spiegelglas, Michael Rotman +2Multi-Object TrackingVideo Object Segmentation

  29. Segmenting, Fast and Slow: Real-Time Open-Vocabulary Video Instance Segmentation with Dual-Path Processing

    Jun 30, 2026Luca Barsellotti, Martin Sundermeyer, Mattia Segu +5Video Object SegmentationOpen-Vocabulary Object Detection

  30. Distilling Temporal Coherence into 2D Networks for Transrectal Ultrasound Prostate Video Segmentation

    Jun 30, 2026Dong Yeong Kim, JunGyu Lee, Jaewon Choi +5Video Object SegmentationSpatial Coherence

  31. Event-Aware Instructed Assistant for Referring Video Segmentation

    Jun 25, 2026Jinyu Liu, Henghui Ding, Shuting He +1Video Object SegmentationHierarchical

  32. FeVOS: Foresight Expression Video Object Segmentation

    Jun 24, 2026Kehan Lan, Kaining Ying, Henghui DingVideo Object SegmentationSpatio-Temporal Reasoning

  33. Boosting Text-Driven Video Segmentation via Geometry-Aware Distillation

    Jun 23, 2026Tianyu Zhu, Yingping Liang, Hesong Li +1Video Object SegmentationVisual Geometry Grounded Transformer

  34. Rethinking Object-Centric Representations for Video Dynamics Modeling

    Jun 22, 2026Amaury Wei, Ismail Nejjar, Olga FinkVideo Object SegmentationMulti-Object Tracking

  35. Towards Accurate and Robust Surveillance Roadside IVD via Trackletized Audio-Visual Reasoning

    Jun 21, 2026Xiwen Li, Xiaoya Tang, Bodong Zhang +1Automotive DetectionVideo Object Segmentation

  36. ARTEMIS: Agent-guided Reliability-aware Temporal Mask Evolution for Imperfectly Supervised Video Polyp Segmentation

    Jun 18, 2026Tong Wang, Siwen Wang, Yaolei Qi +4Video Object SegmentationPolyp Segmentation

  37. SA-VIS: Sparse frame Annotations for training Video Instance Segmentation

    Jun 18, 2026Edoardo Mello Rella, Ajad Chhatkuli, Shipra Jain +2Video Object SegmentationDense Annotation

  38. Open-World Video Segmentation

    Jun 14, 2026Qing Su, Kaiyang Li, Yuan Zhuang +2Video Object SegmentationDiscovery

  39. Mind the Gap: Disentangling Performance Bottlenecks in Video Instance Segmentation

    Jun 5, 2026Danial Hamdi, Fardin Ayar, Mahdi JavanmardiVideo Object SegmentationLong Videos

  40. VideoSEG-O3: A Multi-turn Reinforcement Learning Framework for Reasoning Video Object Segmentation

    Jun 5, 2026Ming Dai, Sen Yang, Boqiang Duan +4Video Object SegmentationChain-of-Thought Reasoning

  41. Scene-Centric Unsupervised Video Panoptic Segmentation

    Jun 3, 2026Christoph Reich, Oliver Hahn, Nikita Araslanov +4Video Object SegmentationPanoptic Segmentation

  42. GMOS: Grounding Moving Object Segmentation in 3D Space and Time

    May 28, 2026Junyu Xie, Tengda Han, Weidi Xie +1Video Object SegmentationMulti-Object Tracking

  43. GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver

    May 28, 2026Yuqing Chen, Lin Liu, Haisu Wu +4Video Object RemovalText-To-Video Diffusion Models

  44. Leveraging Text-to-Image Diffusion Models for Unsupervised Visual Object Tracking

    May 26, 2026Zhengbo Zhang, Zhigang Tu, Junsong Yuan +2Multi-Object TrackingVideo Object Segmentation

  45. Occlusion-Aware Physics-Semantic Keyframe Selection for Robust Video Editing

    May 22, 2026Lin Liu, Zhihan Xiao, Haohang Xu +4Video EditingKeyframe Selection

  46. Segment Anything with Motion, Geometry, and Semantic Adaptation for Complex Nonlinear Visual Object Tracking

    May 21, 2026Deyi Zhu, Yuji Wang, Yong Liu +4Multi-Object TrackingVideo Object Segmentation

  47. Don't Guess, Just Ask: Resolving Ambiguity in Referring Segmentation via Multi-turn Clarification

    May 17, 2026Yuting Yang, Haichao Jiang, Tianming Liang +2Video Object SegmentationAmbiguity

  48. Beyond Detection: A Structure-Aware Framework for Scene Text Tracking

    May 17, 2026Chenmin Yu, Liu Yu, Daiqing Wu +3Scene Text RecognitionMulti-Object Tracking

  49. SteerSeg: Attention Steering for Reasoning Video Segmentation

    May 14, 2026Ali Cheraghian, Hamidreza Dastmalchi, Abdelwahed Khamis +3Video Object SegmentationVision-Language Model Grounding