Video Generation

Momentum

32 papers in the last four weeks, up 146% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 241

All topics
CardsList
  1. MilliVid: Hierarchical Latents for Long-Range Consistency in Video Generation

    Jun 8, 2026Ishaan Preetam Chandratreya, David Charatan, Basile Van Hoorick +4Video Diffusion ModelsLong Video Generation

  2. BioVid: Autoregressive Video Generation with Biological Behavior Semantic Comprehension

    Jun 7, 2026Tsung-Wei Pan, Jung-Hua WangVideo GenerationAutoregressive Video Generation

  3. TIDE: Task-Isolated Diffusion for Unified Video Editing and Generation

    Jun 6, 2026Qi Liu, Gang Yue, Mingyu Yin +7Video Diffusion ModelsVideo Editing

  4. CultureScore: Evaluating Cultural Faithfulness in Video Generation Models

    Jun 5, 2026Anku Rani, Wei Dai, Shravan Nayak +3Video GenerationVideo Generation Evaluation

  5. Activation Steering of Video Generation Models via Reduced-Order Linear Optimal Control

    Jun 3, 2026Jihoon Hong, Alice Chan, Qiyue Dai +2Text-to-Video GenerationVideo Generation

  6. Steady-Forcing: Balancing Spatial Persistence and Motion Continuity in Long-Horizon Nature Video Diffusion

    Jun 2, 2026Matiur Rahman Minar, Seunghun Oh, GangHyeon Jeong +1Physical Consistency in Video GenerationLong-Horizon Video Generation

  7. Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation

    Jun 1, 2026Yuheng Chen, Teng Hu, Yuji Wang +3Diffusion Model GuidanceVideo Diffusion Models

  8. Auteur: Language-Driven Cinematographic Framing for Human-Centric Video Generation

    Jun 1, 2026Muhammed Burak Kizil, Enes Sanli, Niloy J. Mitra +4Camera-Controlled Video GenerationVideo Generation

  9. SafeGen-Bench: Benchmarking Safety in Image-Conditioned Text-to-Video Generation

    May 31, 2026Yingzi Ma, Xiaogeng Liu, Yawen Zheng +1Image-to-Video GenerationText-to-Video Generation

  10. Knowledge-Intensive Video Generation

    May 31, 2026Chenxu Wang, Mingda ChenText-to-Video GenerationVideo Generation

  11. Lumos-Nexus: Efficient Frequency Bridging with Homogeneous Latent Space for Video Unified Models

    May 29, 2026Jiazheng Xing, Hangjie Yuan, Lingling Cai +9Video Generation

  12. TunerDiT: Training-free Progressive Steering of Diffusion Transformer for Multi-Event Video Generation

    May 29, 2026Ruotong Liao, Guowen Huang, Qing Cheng +6Diffusion TransformerText-to-Video Generation

  13. YoCausal: How Far is Video Generation from World Model? A Causality Perspective

    May 28, 2026You-Zhe Xie, Yu-Hsuan Li, Jie-Ying Lee +3Video Diffusion ModelsCausal World Models

  14. KGEdit: Ambiguity-Aware Knowledge Graphs for Training-Free Precise Video Generation and Editing

    May 28, 2026Mingshu Cai, Miao Zhang, Chenghe Yang +3Video Diffusion ModelsText-to-Video Generation

  15. Which Pretraining Paradigm Better Serves Spatial Intelligence? An Empirical Comparison of Vision-Language and Video Generation Models

    May 27, 2026Haozhan Shen, Tiancheng Zhao, Kangjia Zhao +1Vision-Language ModelsVisual Spatial Reasoning

  16. CogPortrait: Fine-Grained Eye-Region Control in Portrait Animation via Hierarchical Agent Planning

    May 27, 2026He Feng, Yongjia Ma, Donglin Di +2Audio-Driven Facial AnimationVideo Generation

  17. What-If World: A Causal Benchmark for General World Models in Embodied Scenarios

    May 26, 2026Kunlin Cai, Rui Song, Jinghuai Zhang +7Physical Consistency in Video GenerationCausal World Models

  18. BEAT: Rhythm-Elastic Alignment for Agentic Music-guided Movie Trailer Generation

    May 26, 2026Yutong Wang, Yunke Wang, Xinyuan Chen +1Audio-Video GenerationVideo Generation

  19. Are Video Models Zero-Shot Learners and Reasoners in Education? EduVideoBench, A Knowledge-Skills-Attitude Benchmark for Educational Video Generation

    May 26, 2026Unggi Lee, Hoyoung Ahn, Yoon Choi +16Generative AI in EducationVideo Generation

  20. PixelWizard: Towards Efficient High-Fidelity Video Generation at Ultra-Large Spatial Resolution

    May 25, 2026Wenxue Li, Jingjing Ren, Peng Zhang +4Video Diffusion ModelsFew-Step Diffusion Sampling

  21. Test-Time Self-Adaptive Conditioning for Stable Audio-Driven Talking-Head Generation

    May 25, 2026Zhicheng Zhang, Lei Wang, Yu Zhang +1Test-Time AdaptationTalking Head Generation

  22. Pantheon360: Taming Digital Twin Generation via 3D-Aware 360° Video Diffusion

    May 25, 2026Ting-Hsuan Chen, Ying-Huan Chen, Tao Tu +10Video-Reference Video GenerationCamera-Controlled Video Generation

  23. Loki: Representation over Architecture for Diffusion-Based Portrait Animation

    May 22, 2026Pouyan Navard, Sernam LimVideo Diffusion Models3D Morphable Models