Video Generation

Momentum

48 papers in the last four weeks, up 380% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. PhyWorld: Physics-Faithful World Model for Video Generation

    May 19, 2026Pu Zhao, Juyi Lin, Timothy Rupprecht +10Generative Video ModelsVideo Generation

  2. Spectral Progressive Diffusion for Efficient Image and Video Generation

    May 18, 2026Howard Xiao, Brian Chao, Lior Yariv +1Video GenerationHigh-Resolution

  3. Lance: Unified Multimodal Modeling by Multi-Task Synergy

    May 18, 2026Fengyi Fu, Mengqi Huang, Shaojin Wu +10Multimodal UnderstandingMulti--Task Learning

  4. NEWTON: Agentic Planning for Physically Grounded Video Generation

    May 18, 2026Yuxiang Feng, Juncheng Wang, Chao Xu +7Video GenerationIterative Re-Planning

  5. GeoFlow: Enforcing Implicit Geometric Consistency in Video Generation

    May 18, 2026Jan Ackermann, Shengqu Cai, Boyang Deng +3Generative Video ModelsText-To-Video Diffusion Models

  6. EntityBench: Towards Entity-Consistent Long-Range Multi-Shot Video Generation

    May 14, 2026Ruozhen He, Meng Wei, Ziyan Yang +1Interactive Video GenerationVideo Generation

  7. RefDecoder: Enhancing Visual Generation with Conditional Video Decoding

    May 14, 2026Xiang Fan, Yuheng Wang, Bohan Fang +2Video GenerationConditional Variational Autoencoder

  8. Warp-as-History: Generalizable Camera-Controlled Video Generation from One Training Video

    May 14, 2026Yifan Wang, Tong HeCamera ControlVideo Generation

  9. Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation

    May 14, 2026Min Zhao, Hongzhou Zhu, Kaiwen Zheng +6Video GenerationAutoregressive Model

  10. DriveCtrl: Conditioned Sim-to-Real Driving Video Generation

    May 14, 2026Haonan Zhao, Yiting Wang, Jingkun Chen +3Video GenerationSynthetic-To-Real Domain Gap

  11. Compositional Video Generation via Inference-Time Guidance

    May 14, 2026Ariel Shaulov, Eitan Shaar, Amit Edenzon +2Video GenerationGuidance

  12. MechVerse: Evaluating Physical Motion Consistency in Video Generation Models

    May 14, 2026Rahul Jain, Mayank Patel, Asim Unmesh +1Video GenerationKinematics

  13. Head Forcing: Long Autoregressive Video Generation via Head Heterogeneity

    May 14, 2026Jiahao Tian, Yiwei Wang, Gang Yu +1Autoregressive Video Diffusion ModelsAutoregressive Video Generation

  14. Delta Forcing: Trust Region Steering for Interactive Autoregressive Video Generation

    May 14, 2026Yuheng Wu, Xiangbo Gao, Tianhao Chen +4Autoregressive Video GenerationVideo Generation

  15. CreFlow: Corrective Reflow for Sparse-Reward Embodied Video Diffusion RL

    May 14, 2026Zhenyang Ni, Yijiang Li, Ruochen Jiao +7Video GenerationReinforcement Learning Post-Training

  16. PhyMotion: Structured 3D Motion Reward for Physics-Grounded Human Video Generation

    May 14, 2026Yidong Huang, Zun Wang, Han Lin +6Human Motion Generation3D Motion

  17. TIE: Time Interval Encoding for Video Generation over Events

    May 11, 2026Zhilei Shu, Shangwen Zhu, Zihang Liang +10Temporal GroundingVideo Generation

  18. WorldReasonBench: Human-Aligned Stress Testing of Video Generators as Future World-State Predictors

    May 11, 2026Keming Wu, Yijing Cui, Wenhan Xue +11Long Video GenerationVideo Generation

  19. CollabVR: Collaborative Video Reasoning with Vision-Language and Video Generation Models

    May 9, 2026Joowon Kim, Seungho Shin, Joonhyung Park +1Video UnderstandingVisual Reasoning

  20. ActCam: Zero-Shot Joint Camera and 3D Motion Control for Video Generation

    May 7, 2026Omar El Khalifi, Thomas Rossi, Oscar Fossey +6Camera-Conditioned Video GenerationVideo Generation

  21. Stream-T1: Test-Time Scaling for Streaming Video Generation

    May 6, 2026Yijing Tu, Shaojin Wu, Mengqi Huang +4Video GenerationStreaming

  22. Video Generation with Predictive Latents

    May 4, 2026Yian Zhao, Feng Wang, Qiushan Guo +4Conditional Variational AutoencoderVideo Generation

  23. YOSE: You Only Select Essential Tokens for Efficient DiT-based Video Object Removal

    Apr 30, 2026Chenyang Wu, Lina Lei, Fan Li +6Video Object RemovalVideo Object Segmentation

  24. A Systematic Post-Train Framework for Video Generation

    Apr 28, 2026Zeyue Xue, Siming Fu, Jie Huang +9Video GenerationPost-Training

  25. Alice v1: Distillation-Enhanced Video Generation Surpassing Closed-Source Models

    Apr 27, 2026Wang Xiaoyu, Phong Nguyen, Chen ZhaoGenerative Video ModelsVideo Generation

  26. Video Analysis and Generation via a Semantic Progress Function

    Apr 24, 2026Gal Metzer, Sagi Polaczek, Ali Mahdavi-Amiri +2Video Generation

  27. ID-Eraser: Proactive Defense Against Face Swapping via Identity Perturbation

    Apr 23, 2026Junyan Luo, Peipeng Yu, Jianwei Fei +4Deepfake DetectionModel-Agnostic Defense

  28. HumanScore: Benchmarking Human Motions in Generated Videos

    Apr 22, 2026Yusu Fang, Tiange Xiang, Tian Tan +4Generative Video ModelsHuman Motion Generation

  29. Memorize When Needed: Decoupled Memory Control for Spatially Consistent Long-Horizon Video Generation

    Apr 20, 2026Yanjun Guo, Zhengqiang Zhang, Pengfei Wang +3Video GenerationSpatio-Temporal Attention

  30. LIVE: Leveraging Image Manipulation Priors for Instruction-based Video Editing

    Apr 18, 2026Weicheng Wang, Zhicheng Zhang, Zhongqi Zhang +6Video EditingVideo Dataset

  31. AnimationBench: Are Video Models Good at Character-Centric Animation?

    Apr 16, 2026Leyi Wu, Pengjun Fang, Kai Sun +8Generative Video ModelsVideo Generation

  32. Salt: Self-Consistent Distribution Matching with Cache-Aware Training for Fast Video Generation

    Apr 3, 2026Xingtong Ge, Yi Zhang, Yushi Huang +6Autoregressive Video GenerationVideo Generation

  33. Video Generation Models as World Models: Efficient Paradigms, Architectures and Algorithms

    Mar 30, 2026Muyang He, Hanzhong Guo, Junxiong Lin +1Generative Video ModelsVideo World Models

  34. Adaptive Weighted h-Transform Sampling for Coarse-Guided Visual Generation

    Mar 12, 2026Yanghao Wang, Ziqi Jiang, Zhen Wang +1Diffusion SamplingVisual Generation

  35. Controllable Egocentric Video Generation via Occlusion-Aware Sparse 3D Hand Joints

    Mar 12, 2026Chenyangguang Zhang, Botao Ye, Boqi Chen +43D HandEgocentric Video

  36. FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion

    Feb 5, 2026Zhuokun Chen, Jianfei Cai, Bohan ZhuangDiffusion Language ModelsEfficient Long-Context Inference

  37. Beyond Inpainting: Unleash 3D Understanding for Stable Camera-Controlled Video Generation

    Jan 15, 2026Dong-Yu Chen, Yixin Guo, Shuojin Yang +2Camera ControlVideo Generation

  38. Mixture of Distributions Matters: Dynamic Sparse Attention for Efficient Video Diffusion Transformers

    Jan 14, 2026Yuxi Liu, Yipeng Hu, Zekun Zhang +2Video Diffusion ModelsDiffusion Transformers

  39. Motion Attribution for Video Generation

    Jan 13, 2026Xindi Wu, Despoina Paschalidou, Jun Gao +5Generative Video ModelsVideo Generation

  40. GeCo: Evaluating Geometric Consistency for Video Generation via Motion and Structure

    Dec 25, 2025Leslie Gu, Junhwa Hur, Charles Herrmann +4Generative Video ModelsVideo Generation

  41. GimbalDiffusion: Gravity-Aware Camera Control for Video Generation

    Dec 9, 2025Frédéric Fortier-Chouinard, Yannick Hold-Geoffroy, Valentin Deschaintre +2Camera ControlCamera Trajectories

  42. WorldWander: Bridging Egocentric and Exocentric Worlds in Video Generation

    Nov 27, 2025Quanjian Song, Yiren Song, Kelly Peng +2Egocentric VideoVideo World Models

  43. PhysChoreo: Physics-Controllable Video Generation with Part-Aware Semantic Grounding

    Nov 25, 2025Haoze Zhang, Tianyu Huang, Zichen Wan +4Generative Video ModelsVideo Generation

  44. Taming Text-to-Sounding Video Generation via Advanced Modality Condition and Interaction

    Oct 3, 2025Kaisi Guan, Xihua Wang, Zhengfeng Lai +5Audio-Video GenerationVideo Generation

  45. LoT-Pass: Long-term-robust Image Watermarking for Image to Video Generation

    Sep 22, 2025Guanjie Wang, Zehua Ma, Han Fang +1WatermarksWatermarking

  46. CineScale: Tuning-Free High-Resolution Video Generation

    Aug 21, 2025Gordon Chen, Haonan Qiu, Ning Yu +3Video Generation

  47. HunyuanVideo-HOMA: Generic Human-Object Interaction in Multimodal Driven Human Animation

    Jun 10, 2025Ziyao Huang, Zixiang Zhou, Juan Cao +9Articulated ObjectsHuman Motion Generation

  48. Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute

    Apr 23, 2025Daneul Kim, Jingxu Zhang, Wonjoon Jin +4Interactive Video GenerationVideo Generation

  49. Evaluating Newtonian Mechanics in Video Generative Models with Real Physical Systems

    Apr 3, 2025Antonios Tragoudaras, Chenyu Zhang, Daniil Cherniavskii +7Generative Video ModelsPhysical Plausibility

  50. MMGR: Multi-Modal Generative Reasoning Benchmark and Evaluation

    Date pendingZefan Cai, Haoyi Qiu, Tianyi Ma +13Multimodal Reasoning BenchmarksVideo Generation