Video Generation

Momentum

32 papers in the last four weeks, up 146% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 241

All topics
CardsList
  1. TS-Attn: Temporal-wise Separable Attention for Multi-Event Video Generation

    Apr 21, 2026Hongyu Zhang, Yufan Deng, Zilin Pan +6Image-to-Video GenerationText-to-Video Generation

  2. AutoAWG: Adverse Weather Generation with Adaptive Multi-Controls for Automotive Videos

    Apr 21, 2026Jiagao Hu, Daiguo Zhou, Danzhen Fu +6Synthetic Data AugmentationLong-Horizon Video Generation

  3. OmniHuman: A Large-scale Dataset and Benchmark for Human-Centric Video Generation

    Apr 20, 2026Lei Zhu, Xing Cai, Yingjie Chen +6Audio-Video GenerationVideo Generation

  4. FlowC2S: Flowing from Current to Succeeding Frames for Fast and Memory-Efficient Video Continuation

    Apr 19, 2026Hovhannes Margaryan, Quentin Bammey, Christian SandorFlow MatchingText-to-Video Generation

  5. DreamShot: Personalized Storyboard Synthesis with Video Diffusion Prior

    Apr 19, 2026Junjia Huang, Binbin Yang, Pengxiang Yan +6Video Diffusion ModelsVideo Generation

  6. MotionScape: A Motion-Stratified UAV Video Benchmark for World Modeling and Future Video Generation

    Apr 9, 2026Zile Guo, Zhan Chen, Xiaoxuan Liu +5Aerial RoboticsVideo Generation

  7. Salt: Self-Consistent Distribution Matching with Cache-Aware Training for Fast Video Generation

    Apr 3, 2026Xingtong Ge, Yi Zhang, Yushi Huang +6Diffusion Model DistillationVideo Generation

  8. TrajectoryMover: Generative Movement of Object Trajectories in Videos

    Mar 31, 2026Kiran Chhatre, Hyeonho Jeong, Yulia Gryaditskaya +3Synthetic Data GenerationVideo Editing

  9. Video Generation Models as World Models: Efficient Paradigms, Architectures and Algorithms

    Mar 30, 2026Muyang He, Hanzhong Guo, Junxiong Lin +1Video GenerationVideo World Models

  10. RefAlign: Representation Alignment for Reference-to-Video Generation

    Mar 26, 2026Lei Wang, YuXin Song, Ge Wu +5Diffusion Model AlignmentVideo Diffusion Models

  11. OmniWeaving: Towards Unified Video Generation with Free-form Composition and Reasoning

    Mar 25, 2026Kaihang Pan, Qi Tian, Jianwei Zhang +12Multimodal GenerationVideo Generation

  12. VIGOR: VIdeo Geometry-Oriented Reward for Temporal Generative Alignment

    Mar 17, 2026Tengjiao Yin, Jinglei Shi, Heng Guo +1Diffusion Model AlignmentMulti-View Consistency

  13. Tri-Prompting: Video Diffusion with Unified Control over Scene, Subject, and Motion

    Mar 16, 2026Zhenghong Zhou, Xiaohang Zhan, Zhiqin Chen +8Video GenerationControllable Video Generation

  14. COMIC: Agentic Sketch Comedy Generation

    Mar 11, 2026Susung Hong, Brian Curless, Ira Kemelmacher-Shlizerman +1Agentic Video GenerationComputational Creativity

  15. EmbedTalk: Talking Head Synthesis using Gaussian Embeddings

    Mar 8, 2026Arpita Saggar, Jonathan C. Darling, Duygu Sarikaya +13D Gaussian SplattingTalking Head Generation

  16. UCM: Unified Modeling of Camera Control and Memory with Time-aware Positional Encoding Warping for World Models

    Feb 26, 2026Tianxing Xu, Zixuan Wang, Guangyuan Wang +5Camera-Controlled Video GenerationVideo Diffusion Models

  17. PISCES: Annotation-free Text-to-Video Post-Training via Optimal Transport-Aligned Rewards

    Feb 2, 2026Minh-Quan Le, Gaurav Mittal, Cheng Zhao +3Text-to-Video GenerationVideo Generation

  18. Slot-ID: Identity-Preserving Video Generation from Reference Videos via Slot-Based Temporal Identity Encoding

    Jan 4, 2026Yixuan Lai, He Wang, Kun Zhou +1Video Diffusion ModelsText-to-Video Generation

  19. GeCo: Evaluating Geometric Consistency for Video Generation via Motion and Structure

    Dec 25, 2025Leslie Gu, Junhwa Hur, Charles Herrmann +4Physical Consistency in Video GenerationVideo Generation

  20. CustomX: Unified Character, Action, and Scene Customization in Video World Models

    Dec 18, 2025Yitong Wang, Fangyun Wei, Hongyang Zhang +2HOI GenerationAction-Conditioned Video Generation

  21. Transform Trained Transformer for Accelerating Native 4K Video Generation

    Dec 15, 2025Jiangning Zhang, Junwei Zhu, Teng Hu +9Efficient Transformer InferenceEfficient Attention

  22. Rethinking Reward Signals in Video GRPO: When Scores Become Targets

    Nov 24, 2025Rui Li, Yuanzhi Liang, Ziqi Ni +3Reward HackingRL for Video Generation

  23. UniVideo: Unified Understanding, Generation, and Editing for Videos

    Oct 9, 2025Cong Wei, Quande Liu, Zixuan Ye +5Image-to-Video GenerationUnified Multimodal Models

  24. What Drives Compositional Generalization in Visual Generative Models? The Importance of Continuous Training Objectives

    Oct 3, 2025Karim Farid, Rajat Sahay, Yumna Ali Alnaggar +4Compositional Image GenerationGenerative Modeling

  25. CineScale: Tuning-Free High-Resolution Video Generation

    Aug 21, 2025Gordon Chen, Haonan Qiu, Ning Yu +3Rotary Positional EmbeddingsVideo Diffusion Models

  26. Learning Zero-Shot Subject-Driven Video Generation Using 1% Compute

    Apr 23, 2025Daneul Kim, Jingxu Zhang, Wonjoon Jin +4Zero-Shot LearningVideo Diffusion Models

  27. Lifelong Learning of Video Diffusion Models From a Single Video Stream

    Jun 7, 2024Jason Yoo, Yingchen He, Saeid Naderiparizi +4Video Diffusion ModelsVideo Generation

  28. From Pixels to Portraits: A Comprehensive Survey of Talking Head Generation Techniques and Applications

    Aug 30, 2023Shreyank N Gowda, Dheeraj Pandey, Shashank Narayana GowdaAudio-Video GenerationTalking Head Generation

  29. Dream4D: Lifting Camera-Controlled I2V towards Spatiotemporally Consistent 4D Generation

    Date pendingXiaoyan Liu, Kangrui Li, Jiaxin Liu +2Camera-Controlled Video GenerationImage-to-Video Generation