Video QA

QA: Question Answering

Momentum

14 papers in the last four weeks, down 48% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 137

All topics
CardsList
  1. SF20K Competition 2025: Summary and findings

    May 2, 2026Ridouane Ghermi, Xi Wang, Vicky Kalogeiton +1VLM EvaluationVideo Understanding

  2. CurEvo: Curriculum-Guided Self-Evolution for Video Understanding

    Apr 29, 2026Guiyi Zeng, Junqing Yu, Yi-Ping Phoebe Chen +3Video QACurriculum Learning

  3. Interactive Episodic Memory with User Feedback

    Apr 27, 2026Nikesh Subedi, Loris Bazzani, Ziad Al-HalahEgocentric Video QAEpisodic Memory

  4. Don't Pause! Every prediction matters in a streaming video

    Apr 27, 2026Dibyadip Chatterjee, Zhanzhong Pang, Fadime Sener +2Streaming Video UnderstandingEfficient VLM Inference

  5. UpstreamQA: A Modular Framework for Explicit Reasoning on Video Question Answering Tasks

    Apr 25, 2026Jason Nguyen, Ameet Rao, Alexander Chang +2Multimodal Large Language ModelsVideo QA

  6. Grounding Video Reasoning in Physical Signals

    Apr 23, 2026Alibay Osmanli, Zixu Cheng, Shaogang GongTemporal Video GroundingVideo QA

  7. CCTVBench: Contrastive Consistency Traffic VideoQA Benchmark for Multimodal LLMs

    Apr 22, 2026Xingcheng Zhou, Hao Guo, Rui Song +5Visual Question AnsweringVideo QA

  8. Progressive Online Video Understanding with Evidence-Aligned Timing and Transparent Decisions

    Apr 20, 2026Kecheng Zhang, Zongxin Yang, Mingfei Han +6Streaming Video UnderstandingEfficient VLM Inference

  9. When Text Hijacks Vision: Benchmarking and Mitigating Text Overlay-Induced Hallucination in Vision Language Models

    Apr 19, 2026Cui Yakun, Xingqun Qi, TianTian Geng +3VLM EvaluationVLM Hallucination

  10. ForeSea: AI Forensic Search with Multi-modal Queries for Video Surveillance

    Mar 24, 2026Hyojin Park, Yi Li, Janghoon Cho +8Multimodal RAGMultimodal IR

  11. Overreliance on AI in Information-seeking from Video Content

    Mar 20, 2026Anders Giovanni Møller, Elisa Bassignana, Francesco Pierri +1Video QATrust in AI

  12. DynaTokens: Controlling Token Dynamics for Continual Video-Language Understanding

    Mar 2, 2026Toan Nguyen, Yang Liu, Celso De Melo +1Continual LearningVideo QA

  13. NeMo: Needle in a Montage for Video-Language Understanding

    Sep 29, 2025Zi-Yuan Hu, Shuo Liang, Duo Zheng +10Temporal Video GroundingVideo-Language Model Evaluation

  14. ChainReaction: Causal Chain-Guided Reasoning for Modular and Explainable Causal-Why Video Question Answering

    Aug 28, 2025Paritosh Parmar, Eric Peh, Basura FernandoVideo QAMultimodal CoT Reasoning

  15. CausalChaos! Dataset for Comprehensive Causal Action Question Answering Over Longer Causal Chains Grounded in Dynamic Visual Scenes

    Apr 1, 2024Paritosh Parmar, Eric Peh, Ruirui Chen +4Video QACausal Reasoning