Causal Reasoning in Videos

Momentum

6 papers in the last four weeks, up 50% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 34

All topics
CardsList
  1. VepAgent: Bridging Causal-Transition via Tool-Augmented Reinforcement Learning for Video Event Prediction

    Oct 5, 2026Qiutong Chen, Yuchan Guo, Zhenlong Yuan +10Video PredictionCausal Reasoning in Videos

  2. EMBER-Bench: Benchmarking Cross-Event Causal Memory in Long-Horizon Embodied Tasks

    Oct 4, 2026Aoyang Cai, Boning Zhao, Shaoxuan Xie +5Next-Action PredictionEmbodied QA

  3. Causal-EVC: Breaking Emotional Spurious Causality via Spatiotemporal Grounding and Counterfactual Intervention

    Sep 29, 2026Cheng Ye, Weidong Chen, Peipei Song +1Video CaptioningMultimodal Emotion Recognition

  4. When Should the Count Change? Learning State Maintenance for Causal Video Counting

    Sep 28, 2026Pengyiang Liu, Dongyue Lyu, Junbo Niu +3Streaming Video UnderstandingState Tracking

  5. StoryEngine: A State-Grounded Agentic Framework for Video Storytelling

    Sep 27, 2026Yingrui Wang, Zeqing Wang, Yeying JinLong Video GenerationAgentic Video Generation

  6. ReactVAU: A Slow-Fast Decoupled Framework for Streaming Video Anomaly Understanding

    Sep 7, 2026Chia-Hui Chen, Shih-Ying Yeh, Fu-En Yang +2Streaming Video UnderstandingVideo Anomaly Detection

  7. Physically Plausible Video Generation via Visual-Semantic Chain-of-Events Conditioning

    Sep 1, 2026Zixuan Wang, Yixin Hu, Wen Li +4Physical Consistency in Video GenerationVideo Diffusion Models

  8. SocialReasonBench: A Video-QA Benchmark for Social Reasoning with Counterfactual Narrative Videos

    Aug 31, 2026Zheyu Huang, Zijing Shi, Haozhe Luo +4Video QAMultimodal Reasoning

  9. FADE: From Passive Verification to Active Discovery in Counterfactual Video Understanding

    Aug 11, 2026Fufangchen Zhao, Jinhu Fu, Jiachen Lei +3Counterfactual EvaluationVideo QA

  10. Sci-VBench: Evaluating Knowledge- and Reasoning-Intensive Video Generation in Science Domains

    Aug 10, 2026Diandian Zhang, Tingyu Song, Lin Fu +2VLM EvaluationVideo Generation

  11. EgoSafe: A First-Person Mobile-Captured Benchmark for Visual Safety Understanding

    Jul 29, 2026Yuyun Chen, Tianao Li, TianQuan Feng +4Egocentric Video UnderstandingVideo Reasoning

  12. Thinking in Video: Can Video Generators Really Reason About the Real World?

    Jul 20, 2026Yongheng Zhang, Guang Yang, Ruihan Hou +12Video ReasoningCausal Reasoning in Videos

  13. Benchmarking Dynamic Affective Reasoning: A Viewer-Centric Video Emotion Dataset

    Jul 11, 2026Zhiyan Zhang, Peipei Song, Jinpeng Hu +3Video ReasoningCausal Reasoning in Videos

  14. Learning to Deny: Action Denial in Multimodal Large Language Models

    Jun 30, 2026Raiyaan Abdullah, Shehreen Azad, Yogesh Singh RawatMultimodal Large Language ModelsCausal Reasoning in Videos

  15. APT: Atomic Physical Transitions for Causal Video-Language Understanding

    Jun 17, 2026Shang Wu, Haoran Lu, Songling Liu +6VLM AdaptationCausal Reasoning in Videos

  16. CausalMotion: Structured Physical Reasoning as Keyframe and Trajectory Guidance for Training-Free Video Generation

    Jun 12, 2026Sihan Zhuang, Xinyuan Chen, Tianfan Xue +1Physical Consistency in Video GenerationDiffusion Model Guidance

  17. Counterfactual Reasoning for Fine-Grained Evidence Disentanglement in VideoQA

    Jun 8, 2026Zhou Du, Hamid Krim, Xiao Wu +3Causal Representation LearningVideo QA

  18. CACR:Reinforcing Temporal Answer Grounding in Instructional Video via Candidate-Aware Causal Reasoning

    Jun 7, 2026Muge Qi, Rong Fu, Pengbin Feng +7Temporal Video GroundingVideo Understanding

  19. SVI-Bench: A Dynamic Microworld for Strategic Video Intelligence

    May 29, 2026Yulu Pan, Han Yi, Seongsu Ha +4Sports Video AnalysisAI Agent Benchmarks

  20. YoCausal: How Far is Video Generation from World Model? A Causality Perspective

    May 28, 2026You-Zhe Xie, Yu-Hsuan Li, Jie-Ying Lee +3Video Diffusion ModelsCausal World Models

  21. DMC-CF: Dynamic Multimodal CounterFactual QA benchmark for Causal Reasoning

    May 28, 2026Junzhe Zhang, Huixuan Zhang, Guirong Wang +5Counterfactual EvaluationCounterfactual Reasoning in Language Models

  22. What-If World: A Causal Benchmark for General World Models in Embodied Scenarios

    May 26, 2026Kunlin Cai, Rui Song, Jinghuai Zhang +7Physical Consistency in Video GenerationCausal World Models

  23. CRONOS: Benchmarking Counterfactual Physical Consistency in Video Models

    May 22, 2026León Begiristain, Olaf Dünkel, Adam KortylewskiCounterfactual EvaluationPhysical Consistency in Video Generation

  24. CaST-Bench: Benchmarking Causal Chain-Grounded Spatio-Temporal Reasoning for Video Question Answering

    May 22, 2026Mingfang Zhang, Jingjing Pan, Ashutosh Kumar +7VLM EvaluationTemporal Video Grounding

  25. MotiMotion: Motion-Controlled Video Generation with Visual Reasoning

    May 21, 2026Lee Hsin-Ying, Hanwen Jiang, Yiqun Mei +3Physical Consistency in Video GenerationImage-to-Video Generation

  26. WorldReasonBench: Human-Aligned Stress Testing of Video Generators as Future World-State Predictors

    May 11, 2026Keming Wu, Yijing Cui, Wenhan Xue +11World ModelsVideo Reasoning

  27. Perception Without Engagement: Dissecting the Causal Discovery Deficit in LMMs

    May 10, 2026Jiafeng Liang, Zhihao Zhu, Zihan Zhang +7Causal DiscoveryMultimodal Large Language Models

  28. Event-Causal RAG: A Retrieval-Augmented Generation Framework for Long Video Reasoning in Complex Scenarios

    May 7, 2026Peizheng Yan, Yu Zhao, Liang Xie +3Retrieval-Augmented GenerationStreaming Video Understanding

  29. KARMA-MV: A Benchmark for Causal Question Answering on Music Videos

    May 5, 2026Archishman Ghosh, Abhinaba Roy, Dorien HerremansAudio-Visual UnderstandingVideo QA

  30. ChainReaction: Causal Chain-Guided Reasoning for Modular and Explainable Causal-Why Video Question Answering

    Aug 28, 2025Paritosh Parmar, Eric Peh, Basura FernandoVideo QAMultimodal CoT Reasoning

  31. TEMPURA: Temporal Event Masked Prediction and Understanding for Reasoning in Action

    May 2, 2025Jen-Hao Cheng, Yi-Hao Peng, Huapeng Zhou +11Temporal Action SegmentationTemporal Video Grounding

  32. CausalChaos! Dataset for Comprehensive Causal Action Question Answering Over Longer Causal Chains Grounded in Dynamic Visual Scenes

    Apr 1, 2024Paritosh Parmar, Eric Peh, Ruirui Chen +4Video QACausal Reasoning