Future Video Prediction

Latest papers 37

All topics
CardsList
  1. Variational Streaming Flow: Probabilistic Forecasting in Physical Time

    Oct 1, 2026Hans Hao-Hsun Hsu, Minseon Gwak, Soon Hoe Lim +2Probabilistic ForecastingVelocity Field

  2. DiffWAM: A Fast and Efficient Navigation World Action Model

    Sep 30, 2026Mo Zhu, Yuze Wu, Xijie Huang +3Aerial Vision-Language NavigationFuture Video Prediction

  3. Foresight at the Event Boundary: Evaluating Physical Prediction in Video World Models

    Sep 29, 2026Estela Monserrat Arriaga Santana, Julian Rosas Scull, Ehécatl Sacamch'en Núñez Rico +1Future Video PredictionWorld Models

  4. ViBR-WM: Visual Bayesian Regression for World Modeling

    Sep 27, 2026Jifan Li, Ning NingWorld ModelsFuture Video Prediction

  5. MinkowskiPE: Minkowski Positional Encoding for Spatiotemporal Perception

    Sep 27, 2026Yuhao Li, Louie Hong Yao, Tianyi Shi +4Positional EncodingSpatio-Temporal Reasoning

  6. CausalWM: Causal Chain-of-Thought Reasoning for Embodied World Model

    Sep 19, 2026Ziming Xu, Shuang Liang, Ruobing Han +10Efficient World-Action ModelFuture Video Prediction

  7. RiVaT-Fuse: Reliability-Calibrated Variational Tensor Fusion with Matrix-Valued Trust for Multimodal Prediction under Modality Uncertainty

    Sep 9, 2026Yingfan Xu, Tieming Liu, Ye LiangMultimodal ClassificationFuture Video Prediction

  8. SV-WAM: An Efficient Surround-View World-Action Model for End-to-End Autonomous Driving

    Sep 3, 2026Jinyang Wang, Shiwei Li, Junjian Wang +12Efficient World-Action ModelAutonomous Driving

  9. GeoRoute: Geometry-Aware Hybrid Inference for Traffic Future-Frame Prediction

    Aug 10, 2026Khang Minh Le, Hieu Dinh Trung Pham, Luu Thanh Danh +8Future Video PredictionAutonomous Driving

  10. 4D-WAM: Infusing Spatiotemporal Awareness into World Action Models through Trajectory Fields

    Aug 8, 2026Lishan Yang, Wenxuan Song, Xi Wang +14Efficient World-Action ModelFaster-Wam

  11. HOPE: Hand-Object Pressure Estimation from Monocular Videos

    Aug 6, 2026Subin Jeon, Byungjun Kim, Hanbyul JooMonocular VideoMotion Capture

  12. Adaptive-WAM: Quality-Guided Early-Exit Planning from Intermediate Video-Diffusion Features

    Aug 6, 2026Sining Ang, Yuguang Yang, Yan WangDiffusion PlanningWorld Model Planning

  13. HERA: Historical Evidence Routing Adapter for Physical Prediction in Latent World Models

    Aug 6, 2026Yuanruyi, Yue Cao, Haojia Gao +7Future Video PredictionLatent World Models

  14. Predict, Then Retrieve: Cross-Instance Future-State Retrieval from Video Prefixes

    Aug 5, 2026Quynh Vo, Thong Nguyen, Vinh-Hien Do +2Future Video PredictionNext-State Prediction

  15. Multi-Horizon Consistency as Geometry: When Latent Dynamics Contract, and When They Do Not

    Jul 21, 2026Kavya Bhand, Aadi JoshiLatent DynamicsLong-Horizon Inference

  16. MotionForesight: Re-purposing Video Models for Future 3D Scene-Flow Prediction

    Jul 17, 2026Homanga Bharadhwaj, Yash JangirHuman Motion PredictionFuture Video Prediction

  17. Learning Physics-Guided Residual Dynamics for Deformable Object Simulation

    Jul 15, 2026Shivansh Patel, Kaifeng Zhang, Sanjay Pokkali +2Deformable Linear ObjectsPhysics Simulation

  18. LongE2V: Long-Horizon Event-based Video Reconstruction, Prediction, and Frame Interpolation with Video Diffusion Models

    Jul 9, 2026Cheng-De Fan, Chun-Wei Tuan Mu, Chen-Wei Chang +4Video Diffusion ModelsFuture Video Prediction

  19. SUNTA: Hierarchical Video Prediction with Surprise-based Chunking

    Jul 2, 2026Tomoshi Iiyama, Masahiro Suzuki, Yutaka MatsuoLong-Horizon ForecastingFuture Video Prediction

  20. Learning Video Dynamics with Predictive Differentiable Rendering

    Jun 30, 2026Yujin Tang, Tian Zhou, Xin Lin +5Future Video PredictionDifferentiable Rendering

  21. MaskWAM: Unifying Mask Prompting and Prediction for World-Action Models

    Jun 11, 2026Hanyang Yu, Haitao Lin, Jingbo Zhang +4Efficient World-Action ModelFaster-Wam

  22. Efficient-WAM: A 1B-Parameter World-Action Model with Low-Cost Future Imagination

    Jun 8, 2026Jiajun Li, Tiecheng Guo, Yifan Ye +9Efficient World-Action ModelFaster-Wam

  23. Video-Based Prediction of In-Flight Particle Characteristics in Atmospheric Plasma Spraying

    Jun 5, 2026Abhijeet Praveen, Sareh Soleimani, Cormac Cureton +4Future Video PredictionAerial Navigation

  24. What Makes Video World Model Latents Action-Relevant: Prediction over Reconstruction

    Jun 5, 2026Jewon Yeom, Hanseul Kim, Jeongjae Park +3Future Video PredictionWorld

  25. Imagine Before You Predict: Interleaved Latent Visual Reasoning for Video Event Prediction

    Jun 4, 2026Tianxiang Jiang, Linquan Wu, Sheng Xia +5Future Video PredictionLatent Visual Reasoning

  26. Reinforcement Learning from Cross-domain Videos with Video Prediction Model

    Jun 2, 2026Zhao Yang, Xinrui Zu, Jacob E. Kooi +5Future Video PredictionLong Videos

  27. Intercepting the Future: Latent-Space Predictive World Model for Dynamic VLA Manipulation

    Jun 1, 2026Shahram Najam Syed, Arthur Jakobsson, Haoran Hao +1Future Video PredictionLatent World Models

  28. FlowTime: Towards Continuous Generative Watch Time Prediction via Flow-based Personalized Priors

    May 31, 2026Hongxu Ma, Han Zhou, Chenghou Jin +5Future Video PredictionShort Video Bursts

  29. Towards Effective Long-Video Event Prediction via Multi-Level Event Semantics Mining

    May 29, 2026Bo Peng, YuanJie Lyu, PengGang Qin +1Future Video PredictionVideo-Language Models

  30. Nano World Models: A Minimalist Implementation of Future Video Prediction

    May 17, 2026Siqiao Huang, Partha Kaushik, Michael Chen +5Video World ModelsFuture Video Prediction

  31. Latent Video Prediction for World Modeling: An Evaluation Uncovering Intriguing Favorable Evidence

    May 15, 2026Ali J Alrasheed, Aryan Yazdan Parast, Basim Azam +2Future Video PredictionVideo Foundation Models

  32. Learning Visual Feature-Based World Models via Residual Latent Action

    May 8, 2026Xinyu Zhang, Zhengtong Xu, Yutian Tao +3Latent World ModelsLatent Action Models

  33. Event-based Scene Synthesis via Inter-Frame Residual Alignment

    Dec 19, 2025Jiyun Kong, Jun-Hyuk Kim, Jong-Seok LeeOptical FlowScene Reconstruction

  34. State-Change Learning for Prediction of Future Events in Endoscopic Videos

    Oct 14, 2025Saurav Sharma, Chinedu Innocent Nwoye, Didier Mutter +1Surgical VideosFuture Video Prediction