Video Frame Selection

Momentum

5 papers in the last four weeks, up 67% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 46

All topics
CardsList
  1. Occlusion-Aware Physics-Semantic Keyframe Selection for Robust Video Editing

    May 22, 2026Lin Liu, Zhihan Xiao, Haohang Xu +4Video Diffusion ModelsVideo Editing

  2. Swift Sampling: Selecting Temporal Surprises via Taylor Series

    May 21, 2026Dahye Kim, Bhuvan Sachdeva, Karan Uppal +3Video Frame SelectionLong-Video QA

  3. EgoExoMem: Cross-View Memory Reasoning over Synchronized Egocentric and Exocentric Videos

    May 18, 2026Ruiping Liu, Junwei Zheng, Yufan Chen +7Multimodal MemoryVideo QA

  4. FrameSkip: Learning from Fewer but More Informative Frames in VLA Training

    May 13, 2026Bin Yu, Shijie Lian, Xiaopeng Lin +8Visuomotor Policy LearningVision-Language-Action Models

  5. AdaFocus: Adaptive Relevance-Diversity Sampling with Zero-Cache Look-back for Efficient Long Video Understanding

    May 13, 2026Xiao Yang, Yingzhe Ma, Haoxuan Yu +2Efficient VLM InferenceLong-Video Understanding

  6. LDDR: Linear-DPP-Based Dynamic-Resolution Frame Sampling for Video MLLMs

    May 12, 2026Jingfeng Chen, Jiawen Qian, Wendi Deng +5Efficient VLM InferenceMultimodal Large Language Models

  7. GridProbe: Posterior-Probing for Adaptive Test-Time Compute in Long-Video VLMs

    May 11, 2026Mohamed Eltahir, Lama Ayash, Ali Habibullah +2Efficient VLM InferenceLong-Video Understanding

  8. Fetal Brain Imaging: A Composite Neural Network Approach for Keyframe Detection in Ultrasound Videos

    May 10, 2026Aleksander Zamojski, Kacper Jarczak, Radoslaw RoszczykUltrasound ImagingVideo Frame Selection

  9. CREST: Curvature-Regulated Event-Centric Sampling for Efficient Long-Video Understanding

    May 9, 2026Mehrajul Abadin Miraj, Abdul Mohaimen Al Radi, Shariful Islam Rayhan +4Data SelectionLong-Video Understanding

  10. RCoT-Seg: Reinforced Chain-of-Thought for Video Reasoning and Segmentation

    May 8, 2026Junwei Wen, Deshui Miao, Guangming Lu +2Video Object SegmentationVideo Reasoning

  11. VTAgent: Agentic Keyframe Anchoring for Evidence-Aware Video TextVQA

    May 6, 2026Haibin He, Maoyuan Ye, Jing Zhang +2Video QAVideo Frame Selection

  12. Active Sampling for Ultra-Low-Bit-Rate Video Compression via Conditional Controlled Diffusion

    May 4, 2026Amirhosein Javadi, Shirin Saeedi Bidokhti, Tara JavidiLearned Image CompressionVideo Diffusion Models

  13. HFS-TriNet: A Three-Branch Collaborative Feature Learning Network for Prostate Cancer Classification from TRUS Videos

    Apr 24, 2026Xu Lu, Qianhong Peng, Qihao Zhou +4Medical Image ClassificationUltrasound Imaging

  14. HiMu: Hierarchical Multimodal Frame Selection for Long Video Question Answering

    Mar 19, 2026Dan Ben-Ami, Gabriele Serussi, Kobi Cohen +1Multimodal Large Language ModelsMultimodal QA

  15. FocusGraph: Graph-Structured Frame Selection for Embodied Long Video Question Answering

    Mar 4, 2026Tatiana Zemskova, Solomon Andryushenko, Ilya Obrubov +4Efficient VLM InferenceEgocentric Video QA

  16. Graph Unfolding and Sampling for Transitory Video Keyframe Selection via Gershgorin Disc Alignment

    Aug 3, 2024Sadid Sahami, Gene Cheung, Chia-Wen LinGraph Signal ProcessingVideo Frame Selection