Temporal Video Grounding

Latest papers 109

All topics
CardsList
  1. Static and Dynamic Graph Alignment Network for Temporal Video Grounding

    May 1, 2026Zhanjie Hu, Bolin Zhang, Jianhua Wang +5Temporal Video GroundingTemporal GNNs

  2. ClipTBP: Clip-Pair based Temporal Boundary Prediction with Boundary-Aware Learning for Moment Retrieval

    Apr 30, 2026Ji-Hyeon Kim, Ho-Joong Kim, Seong-Whan LeeTemporal Video GroundingCross-Modal Alignment

  3. OmniVTG: A Large-Scale Dataset and Training Paradigm for Open-World Video Temporal Grounding

    Apr 28, 2026Minghang Zheng, Zihao Yin, Yi Yang +2Temporal Video GroundingLLM Self-Correction

  4. FCMBench-Video: Benchmarking Document Video Intelligence

    Apr 28, 2026Runze Cui, Fangxin Shang, Yehui Yang +3VLM EvaluationDocument Understanding

  5. StoryTR: Narrative-Centric Video Temporal Retrieval with Theory of Mind Reasoning

    Apr 25, 2026Xuanyue Zhong, Yuqiang Xie, Guanqun Bi +2Temporal Video GroundingVideo Understanding

  6. Towards Temporal Compositional Reasoning in Long-Form Sports Videos

    Apr 24, 2026Siyu Cao, Lu Zhang, Ruizhe Zeng +1Temporal Video GroundingTemporal Reasoning

  7. Grounding Video Reasoning in Physical Signals

    Apr 23, 2026Alibay Osmanli, Zixu Cheng, Shaogang GongTemporal Video GroundingVideo QA

  8. ForeSea: AI Forensic Search with Multi-modal Queries for Video Surveillance

    Mar 24, 2026Hyojin Park, Yi Li, Janghoon Cho +8Multimodal RAGMultimodal IR

  9. Keeping the Evidence Chain: Semantic Evidence Allocation for Training-Free Token Pruning in Video Temporal Grounding

    Mar 5, 2026Jiaqi Li, Shuntian Zheng, Yixian Shen +4Temporal Video GroundingVision-Language Grounding

  10. Towards Long-Form Spatio-Temporal Video Grounding

    Feb 26, 2026Xin Gu, Bing Fan, Jiali Yao +5Temporal Video GroundingLong-Context Modeling

  11. ShotFinder: Imagination-Driven Open-Domain Video Shot Retrieval via Web Search

    Jan 30, 2026Tao Yu, Haopeng Jin, Hao Wang +19Temporal Video GroundingCross-Modal Retrieval

  12. NeMo: Needle in a Montage for Video-Language Understanding

    Sep 29, 2025Zi-Yuan Hu, Shuo Liang, Duo Zheng +10Temporal Video GroundingVideo-Language Model Evaluation

  13. TAR: Temporal Anchor-Constrained Reasoning for Video Temporal Grounding

    Aug 11, 2025Chaohong Guo, Xun Mo, Yongwei Nie +3Temporal Video GroundingVision-Language Models

  14. TEMPURA: Temporal Event Masked Prediction and Understanding for Reasoning in Action

    May 2, 2025Jen-Hao Cheng, Yi-Hao Peng, Huapeng Zhou +11Temporal Action SegmentationTemporal Video Grounding

  15. Zero-shot Video Moment Retrieval via Off-the-shelf Multimodal Large Language Models

    Jan 14, 2025Yifang Xu, Yunzhuo Sun, Benxiang Zhai +4Temporal Video GroundingVideo-Language Models