Causal Reasoning in Videos

Momentum

6 papers in the last four weeks, up 50% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 34

All topics
CardsList
  1. VepAgent: Bridging Causal-Transition via Tool-Augmented Reinforcement Learning for Video Event Prediction

    Oct 5, 2026Qiutong Chen, Yuchan Guo, Zhenlong Yuan +10Video PredictionCausal Reasoning in Videos

  2. EMBER-Bench: Benchmarking Cross-Event Causal Memory in Long-Horizon Embodied Tasks

    Oct 4, 2026Aoyang Cai, Boning Zhao, Shaoxuan Xie +5Next-Action PredictionEmbodied QA

  3. Causal-EVC: Breaking Emotional Spurious Causality via Spatiotemporal Grounding and Counterfactual Intervention

    Sep 29, 2026Cheng Ye, Weidong Chen, Peipei Song +1Video CaptioningMultimodal Emotion Recognition

  4. When Should the Count Change? Learning State Maintenance for Causal Video Counting

    Sep 28, 2026Pengyiang Liu, Dongyue Lyu, Junbo Niu +3Streaming Video UnderstandingState Tracking

  5. StoryEngine: A State-Grounded Agentic Framework for Video Storytelling

    Sep 27, 2026Yingrui Wang, Zeqing Wang, Yeying JinLong Video GenerationAgentic Video Generation

  6. ReactVAU: A Slow-Fast Decoupled Framework for Streaming Video Anomaly Understanding

    Sep 7, 2026Chia-Hui Chen, Shih-Ying Yeh, Fu-En Yang +2Streaming Video UnderstandingVideo Anomaly Detection

  7. Physically Plausible Video Generation via Visual-Semantic Chain-of-Events Conditioning

    Sep 1, 2026Zixuan Wang, Yixin Hu, Wen Li +4Physical Consistency in Video GenerationVideo Diffusion Models

  8. SocialReasonBench: A Video-QA Benchmark for Social Reasoning with Counterfactual Narrative Videos

    Aug 31, 2026Zheyu Huang, Zijing Shi, Haozhe Luo +4Video QAMultimodal Reasoning

  9. FADE: From Passive Verification to Active Discovery in Counterfactual Video Understanding

    Aug 11, 2026Fufangchen Zhao, Jinhu Fu, Jiachen Lei +3Counterfactual EvaluationVideo QA

  10. Sci-VBench: Evaluating Knowledge- and Reasoning-Intensive Video Generation in Science Domains

    Aug 10, 2026Diandian Zhang, Tingyu Song, Lin Fu +2VLM EvaluationVideo Generation

  11. EgoSafe: A First-Person Mobile-Captured Benchmark for Visual Safety Understanding

    Jul 29, 2026Yuyun Chen, Tianao Li, TianQuan Feng +4Egocentric Video UnderstandingVideo Reasoning

  12. Thinking in Video: Can Video Generators Really Reason About the Real World?

    Jul 20, 2026Yongheng Zhang, Guang Yang, Ruihan Hou +12Video ReasoningCausal Reasoning in Videos

  13. Benchmarking Dynamic Affective Reasoning: A Viewer-Centric Video Emotion Dataset

    Jul 11, 2026Zhiyan Zhang, Peipei Song, Jinpeng Hu +3Video ReasoningCausal Reasoning in Videos

  14. Learning to Deny: Action Denial in Multimodal Large Language Models

    Jun 30, 2026Raiyaan Abdullah, Shehreen Azad, Yogesh Singh RawatMultimodal Large Language ModelsCausal Reasoning in Videos

  15. APT: Atomic Physical Transitions for Causal Video-Language Understanding

    Jun 17, 2026Shang Wu, Haoran Lu, Songling Liu +6VLM AdaptationCausal Reasoning in Videos

  16. CausalMotion: Structured Physical Reasoning as Keyframe and Trajectory Guidance for Training-Free Video Generation

    Jun 12, 2026Sihan Zhuang, Xinyuan Chen, Tianfan Xue +1Physical Consistency in Video GenerationDiffusion Model Guidance

  17. Counterfactual Reasoning for Fine-Grained Evidence Disentanglement in VideoQA

    Jun 8, 2026Zhou Du, Hamid Krim, Xiao Wu +3Causal Representation LearningVideo QA

  18. CACR:Reinforcing Temporal Answer Grounding in Instructional Video via Candidate-Aware Causal Reasoning

    Jun 7, 2026Muge Qi, Rong Fu, Pengbin Feng +7Temporal Video GroundingVideo Understanding

  19. SVI-Bench: A Dynamic Microworld for Strategic Video Intelligence

    May 29, 2026Yulu Pan, Han Yi, Seongsu Ha +4Sports Video AnalysisAI Agent Benchmarks

  20. YoCausal: How Far is Video Generation from World Model? A Causality Perspective

    May 28, 2026You-Zhe Xie, Yu-Hsuan Li, Jie-Ying Lee +3Video Diffusion ModelsCausal World Models

  21. DMC-CF: Dynamic Multimodal CounterFactual QA benchmark for Causal Reasoning

    May 28, 2026Junzhe Zhang, Huixuan Zhang, Guirong Wang +5Counterfactual EvaluationCounterfactual Reasoning in Language Models

  22. What-If World: A Causal Benchmark for General World Models in Embodied Scenarios

    May 26, 2026Kunlin Cai, Rui Song, Jinghuai Zhang +7Physical Consistency in Video GenerationCausal World Models

  23. CRONOS: Benchmarking Counterfactual Physical Consistency in Video Models

    May 22, 2026León Begiristain, Olaf Dünkel, Adam KortylewskiCounterfactual EvaluationPhysical Consistency in Video Generation

  24. CaST-Bench: Benchmarking Causal Chain-Grounded Spatio-Temporal Reasoning for Video Question Answering

    May 22, 2026Mingfang Zhang, Jingjing Pan, Ashutosh Kumar +7VLM EvaluationTemporal Video Grounding

  25. MotiMotion: Motion-Controlled Video Generation with Visual Reasoning

    May 21, 2026Lee Hsin-Ying, Hanwen Jiang, Yiqun Mei +3Physical Consistency in Video GenerationImage-to-Video Generation

  26. WorldReasonBench: Human-Aligned Stress Testing of Video Generators as Future World-State Predictors

    May 11, 2026Keming Wu, Yijing Cui, Wenhan Xue +11World ModelsVideo Reasoning

  27. Perception Without Engagement: Dissecting the Causal Discovery Deficit in LMMs

    May 10, 2026Jiafeng Liang, Zhihao Zhu, Zihan Zhang +7Causal DiscoveryMultimodal Large Language Models

  28. Event-Causal RAG: A Retrieval-Augmented Generation Framework for Long Video Reasoning in Complex Scenarios

    May 7, 2026Peizheng Yan, Yu Zhao, Liang Xie +3Retrieval-Augmented GenerationStreaming Video Understanding