Video Prediction

Momentum

6 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 45

All topics
CardsList
  1. CRONOS: Benchmarking Counterfactual Physical Consistency in Video Models

    May 22, 2026León Begiristain, Olaf Dünkel, Adam KortylewskiCounterfactual EvaluationPhysical Consistency in Video Generation

  2. Nano World Models: A Minimalist Implementation of Future Video Prediction

    May 17, 2026Siqiao Huang, Partha Kaushik, Michael Chen +5Action-Conditioned Video GenerationLong-Horizon Video Generation

  3. Identifiable Token Correspondence for World Models

    May 15, 2026Youngin Kim, Ray Sun, Inho Kim +2World Model LearningTransformer-Based RL

  4. Latent Video Prediction for World Modeling: An Evaluation Uncovering Intriguing Favorable Evidence

    May 15, 2026Ali J Alrasheed, Aryan Yazdan Parast, Basim Azam +2Video Representation LearningVideo Prediction

  5. CausalGS: Learning Physical Causality of 3D Dynamic Scenes with Gaussian Representations

    May 11, 2026Nengbo Lu, Minghua PanDynamic Scene ReconstructionVideo Prediction

  6. VeloGauss: Learning Physically Consistent Gaussian Velocity Fields from Videos

    May 11, 2026Nengbo Lu, Bin Zhao3D Gaussian SplattingDynamic Scene Reconstruction

  7. Towards Generative Predictive Display for Vision-Based Teleoperation: A Zero-Shot Benchmark of Off-the-Shelf Video Models

    May 10, 2026Aws Khalil, Jaerock KwonVideo Diffusion ModelsRobot Teleoperation

  8. CNN-based Multi-In-Multi-Out Model for Efficient Spatiotemporal Prediction

    May 2, 2026Hyeonseok JinEfficient Neural Network InferencePrecipitation Forecasting

  9. FlowC2S: Flowing from Current to Succeeding Frames for Fast and Memory-Efficient Video Continuation

    Apr 19, 2026Hovhannes Margaryan, Quentin Bammey, Christian SandorFlow MatchingText-to-Video Generation

  10. UniE2F: A Unified Diffusion Framework for Event-to-Frame Reconstruction with Video Foundation Models

    Feb 22, 2026Gang Xu, Zhiyu Zhu, Junhui HouEvent-Based VisionVideo Prediction

  11. UniDrive-WM: Unified Understanding, Planning and Generation World Model for Autonomous Driving

    Jan 7, 2026Zhexiao Xiong, Xin Ye, Burhan Yaman +5Vision-Language ModelsWorld Model Learning

  12. Event-based Scene Synthesis via Inter-Frame Residual Alignment

    Dec 19, 2025Jiyun Kong, Jun-Hyuk Kim, Jong-Seok LeeEvent-Based VisionVideo Prediction

  13. Auto-Regressive Models Need Structural Registers: Semantic Foresight Improves Coherent Driving Video Continuation

    Dec 4, 2024Ruibo Ming, Jingwei Wu, Zhewei Huang +4Video PredictionAutoregressive Video Generation