Video Diffusion Models

Latest papers 208

All topics
CardsList
  1. LoopMoEVR: Loop-Based Degradation-Aware Mixture-of-Experts for Unified UHD Video Restoration

    Oct 4, 2026Yucheng Xin, Runci Bai, Yongcong Wang +5Video Diffusion Models

  2. PartiCam: Camera Controlled Video Generation with Reward Guidance

    Sep 30, 2026Amine Ouasfi, Runjia Li, Junlin Han +3Camera TrajectoriesVideo Diffusion Models

  3. Sparse-WAM: Accelerating World Action Models via Action-Guided Sparse Imagination

    Sep 30, 2026Xinling Xie, Haodong Wang, Jiazhi Mi +8Faster-WamWorld Models

  4. EPIC: Epipolar-Consistent 360° Immersive Stereo Video Generation

    Sep 30, 2026Debabrata Mandal, Dongdong Fu, Jonathon Miller +3Video GenerationVideo Diffusion Models

  5. Breaking the Uniformity Trap: Scaling Video Diffusion Model via SplitMoE

    Sep 29, 2026Yu Xu, Yuxin Zhang, Xiao Yang +7Video Diffusion ModelsLocalized Lora-Moe

  6. Self-Aligned Forcing: Streaming Video Diffusion with Differentiable Noisy History

    Sep 29, 2026Weiqiang Wang, Zhuokun Chen, Yusheng Dai +5Autoregressive Video Diffusion ModelsVideo Diffusion Models

  7. Waypoint-1.5: A Real-Time Video World Model for Consumer Hardware

    Sep 29, 2026Rajit Rajpal, Shahbuland Matiana, Liew Wei Pyn +12Video World ModelsInteractive Video Generation

  8. Motion Concept Unlearning in Video Diffusion Models

    Sep 29, 2026Ping Liu, Chi ZhangText-To-Video Diffusion ModelsVideo Diffusion Models

  9. CoRe: Co-Evolving Reward Models for Mitigating Latent Reward Hacking in Video Diffusion Models

    Sep 28, 2026Zhaolong Su, Yujin Han, Feng Wang +3Video Diffusion ModelsLatent Representation Alignment

  10. PDMD: Projected Distribution Matching Distillation for Video Diffusion Models

    Sep 28, 2026Zimo Wang, Junkun Yuan, Angtian Wang +9Video Diffusion ModelsDistribution Matching Distillation

  11. From Static to Dynamic: On-Policy Distillation from Image to Video Diffusion Models

    Sep 28, 2026Bingqing Jiang, Li Luo, Zichao Yu +3Video Diffusion ModelsDiffusion Models

  12. Enhanced Video Text Editing with Trajectory-Aligned Glyph Rendering

    Sep 28, 2026Shulian Zhang, Xiangyu Shu, Wenbo Li +2Video EditingVideo Diffusion Models

  13. ZoomDiff: A High-Fidelity Diffusion Model for Dual-Camera Smooth Zooming

    Sep 23, 2026Jiayi Zhang, Renlong Wu, Yukang Ding +2Video Diffusion ModelsSharp Transitions

  14. Latent evolving World Action Model

    Sep 23, 2026Xueji Fang, Boqiang Duan, Hua Wu +2Action GenerationWorld Models

  15. Streaming Video Editing with Easy Adaptation

    Sep 21, 2026Yujia Hu, Jiajun Li, Zihao He +1Video EditingVideo Diffusion Models

  16. Why Do Video Diffusion Models Violate Physics? Unveiling the Flaws in Attention Mechanisms

    Sep 20, 2026Yueyan Li, Haibo Wang, Caixia Yuan +1Video Diffusion ModelsMotion

  17. 4DGS-Fixer: Generative Sparse-View 4D Gaussian Splatting with Iterative Refinement Guided by Video Diffusion Priors

    Sep 18, 2026Haitao Huang, Shenghao Zhao, Boyuan Tian +74D ReconstructionSparse-View

  18. Video DeltaNet: A Video-Native Hybrid Attention for Livestream Video Generation

    Sep 17, 2026Haocheng Xi, Yiming Xie, Hexu Zhao +8Video Diffusion ModelsVideo Generation

  19. DART: Distillation-Aware Reparameterization for Training-Free LoRA Reuse in Few-Step Video Diffusion Models

    Sep 17, 2026Shihong Li, Juntao Xu, JinCao +3Video Diffusion ModelsLow-Rank Structure

  20. VideoTok4D: A 4D-Aware Video Tokenizer for Compact World Representation

    Sep 14, 2026Xinyi Chen, Hanxin Zhu, Xijun Wang +4Visual TokenizersVideo Diffusion Models

  21. Decoupled Self-Forcing Distillation for Streaming Talking Head Generation

    Sep 9, 2026Yanru An, Ruiyan Wang, Wenwu Wei +7Video Diffusion ModelsStreaming

  22. StreetDiff: Multi-view Street Scenes Generation via Cross-view Consistent Multi-view Stable Diffusion with Structure Prompts

    Sep 9, 2026Qi Zhang, Yanyifan Wang, Weiyuan Zhang +1Cross-ViewVideo Diffusion Models

  23. RoLA: Rotary-Positioned Low-Rank Linear Attention for Efficient Diffusion Transformers

    Sep 6, 2026Zekun Zhang, Yixiang Cai, Yuxi Liu +9Video Diffusion ModelsSpatio-Temporal Attention

  24. Stabilizing Camera-Controlled Novel View Synthesis at Inference Time

    Sep 3, 2026Prajwal Singh, Arjun Badola, Seema Kumari +2Video Diffusion ModelsCamera Control

  25. CameraEditor: Camera-Controlled Image Editing via Video-Prior Sequential Modeling

    Sep 1, 2026Xin Shen, Chengyou Jia, Keshuo Xing +6Camera ControlVideo Diffusion Models

  26. How Far Can 5,500 Hours of Driving Take You? A Scaling Law Analysis of Video Diffusion Models

    Aug 28, 2026Victor Besnier, Anh-Quan Cao, Elias Ramzi +5Naturalistic Driving DataVideo Diffusion Models

  27. ACE-Ego-Hand: Repurposing Video Diffusion Models for Occlusion-Robust Egocentric 3D Hand Motion Recovery

    Aug 20, 2026Yufei Liu, Xixi Wang, Hao Li +83D HandEgocentric Video

  28. SNM-VFI: Symmetric Nonlinear Motion-Guided Generative Video Frame Interpolation

    Aug 13, 2026Jisoo Jeong, Hong Cai, Jamie Menjay Lin +5Video Diffusion ModelsOptical Flow

  29. LiveAnimate: Stable Long-Form Streaming Human Animation in Real-Time

    Aug 12, 2026Yuxuan Zhang, Haozhong Xiong, Yubo Huang +6Video Diffusion ModelsStreaming

  30. Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation

    Aug 11, 2026Yueting Zhu, Yuehao Song, Kaicheng Zhang +5Video Diffusion ModelsVideo Generation

  31. GeoRoute: Geometry-Aware Hybrid Inference for Traffic Future-Frame Prediction

    Aug 10, 2026Khang Minh Le, Hieu Dinh Trung Pham, Luu Thanh Danh +8Future Video PredictionAutonomous Driving

  32. Vid2WAM: Distilling Video Diffusion Priors into World Action Models

    Aug 9, 2026Chenhao Qiu, Ruixiang Wang, Runyi Zhao +7Efficient World-Action ModelVideo Diffusion Models

  33. MirrorWorld: Taming Video Diffusion Models for Mirror Reflection Generation

    Aug 7, 2026Youjun Zhao, Alex Warren, Gary K. L. Tam +1Video Diffusion ModelsVideo Dataset

  34. Adaptive-WAM: Quality-Guided Early-Exit Planning from Intermediate Video-Diffusion Features

    Aug 6, 2026Sining Ang, Yuguang Yang, Yan WangDiffusion PlanningWorld Model Planning

  35. Diff-VF: Training-free High-quality Long Video Generation via Diffusion Model

    Aug 6, 2026Haoning Yang, Xinyuan Chen, Yaohui Wang +1Video Diffusion ModelsInteractive Video Generation

  36. UniWorld-View: Large-Baseline View Synthesis via Video Diffusion Models

    Aug 5, 2026Haiyang Zhou, Wangbo Yu, Chaoran Feng +3Novel View SynthesisVideo Diffusion Models

  37. LiveLight: Real-time Streaming Video Relighting with Interactive Control

    Aug 3, 2026Yue Ma, Jiangming Wang, Yucheng Wang +8Image RelightingVideo Diffusion Models

  38. DreamTraj: Generating 6-DoF Object Trajectories by Reading Unrendered Video Diffusion Latents

    Aug 1, 2026Tongsheng Ding, Zhen Luo, Yixuan Yang +4Video Diffusion ModelsPerception Pipeline

  39. Video Models as Native 4D Renderers: World-Grounded Conditioning from Animated Mesh

    Jul 30, 2026Junhao Chen, Mingjin Chen, Henghaofan Zhang +9Video Diffusion Models4D

  40. Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion

    Jul 30, 2026Henglin Liu, Fangyuan Kong, Jing Wang +7Text-To-Video Diffusion ModelsVideo Diffusion Models

  41. WildShadowRemover: In-the-Wild Video Shadow Removal via Detail-Preserving Video Diffusion Models

    Jul 28, 2026Jiamin Xu, Cong Wang, Zheng Dong +4Video Diffusion ModelsRemoval

  42. ViDS: Video Diffusion Shader using 3D Face Tracking

    Jul 27, 2026Wenbo Ji, Davide Davoli, Zhe Chen +3Video Diffusion ModelsBlind Face Restoration

  43. OmniCache: Multidimensional Hierarchical Feature Caching For Diffusion Models

    Jul 26, 2026Zhaoyuan He, Muhammad Muaz, Lili QiuVideo Diffusion ModelsDiffusion Models

  44. CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion

    Jul 25, 2026Shreshth Saini, Neil Birkbeck, Yilin Wang +2Video Diffusion ModelsTest Time

  45. AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation Alignment

    Jul 24, 2026Ziyao Huang, Shunkai Li, Juan Cao +7Articulated ObjectsHuman Motion Generation

  46. Streaming Multi-Agent Autoregressive Diffusion Model with World State Registers

    Jul 23, 2026Sicheng Mo, Yuheng Li, Ziyang Leng +2Video World ModelsAutoregressive Video Diffusion Models

  47. Unified Video Dense Prediction from Disjoint Data

    Jul 23, 2026Yihong Sun, Seoung Wug Oh, Jiahui Huang +2Dense PredictionVideo Diffusion Models

  48. Ms. Forcing: Efficient Streaming Video Generation with Multi-Scale Patchification and Attention

    Jul 23, 2026Zekun Li, Xiaoyan Cong, Hongyu Li +5Video Diffusion ModelsMultiscale