Video Generation

Momentum

48 papers in the last four weeks, up 380% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on

    Aug 6, 2026Yushe Cao, Shikun Feng, Fei Shen +5Virtual Try-OnGarments

  2. VideoArgus: Agentic Rubric-Grounded Unified Evaluation for Video Generation and Editing

    Aug 6, 2026Ziyun Zeng, Zixuan Wang, Yongsheng Yu +2Long VideosVideo Generation

  3. muSync-GS: Physics-Synchronized Driving Video Synthesis for Weather and Geometric Road Hazards

    Aug 5, 2026Yang Chen, Yicheng Zhu, Tao Li +1Dynamic Driving ScenesVehicle Dynamics

  4. BRACE: Taming Sharp Irregularities via Barycentric Rational Forecasting for Fast Diffusion Transformers Inference

    Aug 4, 2026Jinlong Yang, Jinke Wu, Lizilin +1Diffusion TransformersExtrapolation

  5. SUV: Future Scene Understanding as Video Generation for End-to-End Driving

    Aug 4, 2026Yibo Yuan, Jiacheng Fu, Jiangtong Zhu +8Video GenerationMechanics

  6. UniMoCa: Unifying Motion and Camera Controls as Visual Proxies for Faithful Human Video Generation

    Aug 3, 2026Liming Tan, Ye Chen, Hao Zhang +3Camera ControlHuman Motion Generation

  7. CultureVidBench: Benchmarking Cultural Understanding in Text-to-Video Generation

    Aug 3, 2026Xianjing Han, Yuhan Su, Yang Deng +3Text-To-Video Generation ModelCultural Awareness

  8. WaiT for the Signal: Simple Frequency-Aware Flow-Matching

    Jul 30, 2026Krunoslav Lehman Pavasovic, Théophane Vallaeys, Stéphane Mallat +4Multi-Reference Image GenerationContrastive Flow Matching

  9. FreqForcing: Autoregressive Long Video Generation via Spectral Self-Anchoring

    Jul 29, 2026Jiatong Li, Leo Liang, Linghe Kong +1Autoregressive Video Diffusion ModelsAutoregressive Video Generation

  10. CineWeaver: Training-Free Reference-Controllable Multi-Shot Long Video Generation for Cinematic Storytelling

    Jul 29, 2026Yuyang Huang, Yabo Chen, Wenrui Dai +6Interactive Video GenerationText-To-Video Diffusion Models

  11. LumaGuide: Distribution Shaping for Training-Free HDR Generation in Diffusion Models

    Jul 28, 2026Bowen Chen, Shreshth Saini, Balu Adsumilli +1Diffusion ModelsHigh Dynamic Range

  12. I2VShield: An Efficient Proactive Defense Framework against DiT-based Image-to-Video Models

    Jul 28, 2026Yimao Guo, Zuomin Qu, Wei LuDiffusion TransformersBlack-Box Adversarial Attacks

  13. FilmBench: A Film-Grade Benchmark for Cinematic Video Generation

    Jul 27, 2026Shengyi Wang, Niantong Li, Guangzheng Hu +27Cinematic IdealLong-Video Benchmarks

  14. AptAvatar: Fast and Vivid Long-Form Audio-Driven Video Generation for Production-Ready Avatars

    Jul 27, 2026Hengyuan Zhang, Jingna Sun, Meiguang Jin +1Audio-Video GenerationVideo Generation

  15. AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation Alignment

    Jul 24, 2026Ziyao Huang, Shunkai Li, Juan Cao +7Articulated ObjectsHuman Motion Generation

  16. Learning Explicit Physical Parameter Control and Benchmarking for Video Generation

    Jul 21, 2026Yanxun Li, Hao Wen, Bingze Song +7Video GenerationHuman Motion Generation

  17. DeforM: Reasoning-Guided Physics-Aware Video Generation via Spatial-Temporal Masking

    Jul 21, 2026Yunyi Li, Yu Qiao, Yaohui Wang +1Generative Video ModelsVideo Generation

  18. Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation

    Jul 20, 2026Zhenjie Liu, Binyan Chen, Hao Chen +2Video GenerationKeyframe Selection

  19. Thinking in Video: Can Video Generators Really Reason About the Real World?

    Jul 20, 2026Yongheng Zhang, Guang Yang, Ruihan Hou +12Generative Video ModelsVideo Generation

  20. PE-Field 4D: Video Generation Models as Canvas

    Jul 17, 2026Yunpeng Bai, Haoxiang Li, Qixing HuangVideo GenerationCamera Trajectories

  21. PhysPlan: Grounded Physical State Reasoning and Graph-Guided Optimization for Physically Plausible Video Generation

    Jul 16, 2026Minh-Loi Nguyen, Xuan-Vu Le, Trung-Nghia Le +3Video Generation

  22. MagicPrompt: Ultra-Lightweight Prompt Tuning for Video Generation

    Jul 16, 2026Yinhan Zhang, Dinwei Tan, Xianghao Kong +3Video Diffusion ModelsVideo Generation

  23. VGIF-Score: Interpretable and Diagnostic Evaluation of Spatio-Temporal Instruction Following in Video Generation

    Jul 15, 2026Songyu Xu, Xin Wang, Qiang Chen +6Video GenerationVisual Fidelity

  24. Bring Music The Horizon: Music-Driven 360∘^\circ Video Generation

    Jul 15, 2026Kai Hsu Tsai, Yong Wei Fu, Hung I Yang +1Dance-To-Music GenerationAudio-Video Generation

  25. Controlling Motion Transfer in Diffusion Transformers via Attention Heads

    Jul 13, 2026Sunyoung Jung, Jiwoo Park, Yoonseok Choi +3Diffusion TransformersVideo Generation

  26. AU-Guided Synthetic Video Generation for Micro-Expression Recognition

    Jul 12, 2026Pei-Sze Tan, Sailaja Rajanala, Yee-Fan Tan +2Video DatasetVideo Generation

  27. GenVid2Robot: From Video Generation to Robot Manipulation via Rigid-Geometric Consistency

    Jul 10, 2026Haohui Huang, Xi Yuan, Panpan Liao +4Robotic ManipulationCamera-Conditioned Video Generation

  28. Video Generation Models are General-Purpose Vision Learners

    Jul 10, 2026Letian Wang, Chuhan Zhang, Rishabh Kabra +9Generative Video ModelsVideo Generation

  29. OpenCoF: Learning to Reason Through Video Generation

    Jul 9, 2026Xinyan Chen, Ziyu Guo, Renrui Zhang +2Video GenerationVideo Understanding

  30. SAGA: Stable Acceleration Guidance for Autoregressive Video Generation

    Jul 9, 2026Thanh-Nhan Vo, Trong-Thuan Nguyen, Trung-Hoang Le +2Autoregressive Video Diffusion ModelsAutoregressive Video Generation

  31. Gen4U: Unifying Video Generation and Understanding via Diffusion

    Jul 7, 2026Michael King, Aravindh Mahendran, Matthew Koichi Grimes +5Video Diffusion ModelsVideo Generation

  32. A Definition and Roadmap for World Models

    Jul 7, 2026Xinyuan Chen, Haoyu Guo, Shi Guo +10World ModelsRoadmap

  33. Video Generation Models Are Inherent Lighting Estimators

    Jul 6, 2026Ziqi Cai, Shuchen Weng, Kaiqi Liu +5LightingIllumination Variations

  34. Lights, Camera, Carbon: Architectural Scaling Laws for Video Generation Energy Consumption

    Jul 5, 2026Nidhal Jegham, Boris Gamazaychikov, Sasha LuccioniVideo Diffusion ModelsVideo Generation

  35. ProxyUp: Training-Free Proxy-Conditioned Video Generation for Controllable Dynamics

    Jul 4, 2026Zanwei Zhou, Jiazhong Cen, Jiemin Fang +7Camera-Conditioned Video GenerationVideo Generation

  36. OrbitQuant: Data-Agnostic Quantization for Image and Video Diffusion Transformers

    Jul 2, 2026Donghyun Lee, Jitesh Chavan, Duy Nguyen +5Diffusion TransformersQuantizer

  37. Ink3D: Sculpting 3D Assets with Extremely Complex Textures via Video Generative Models

    Jul 1, 2026Yue Han, Chong Li, Zhening Liu +53D Generative Models3D Assets

  38. RotateAttention: RoPE-Aware Rotation and Range Rectification for INT4 Quantized Attention in Video Generation

    Jul 1, 2026Yaofu Liu, Wanli Lan, Jinxi Li +2Block Sparse Flash AttentionVideo Diffusion Models

  39. DVG-WM: Disentangled Video Generation Enables Efficient Embodied World Model for Robotic Manipulation

    Jun 30, 2026Ziyu Shan, Zhenyu Wu, Xiaofeng Wang +2Video World ModelsVideo Generation

  40. UnfoldArt: Zero-Shot Recovery of Full Articulated 3D Objects from Text or Image

    Jun 29, 2026Mohamed el Amine Boudjoghra, Ivan Laptev, Angela Dai3D ReconstructionVideo Generation

  41. EcoVideo: Entropy-Orchestrated Video Generation Paradigm in Cloud-Edge Dynamics

    Jun 29, 2026Jiayu Chen, Hengyi Zhang, Maoliang Li +5Video Diffusion ModelsVideo Generation

  42. A Good Talk Does not Look Like a Summary, It Teaches You! Measuring Takeaways from Paper-to-Video Talks

    Jun 26, 2026Ishani Mondal, Aparna Garimella, Ananya Sai +2Scientific FigureSummarization

  43. TempAct: Advancing Temporal Plausibility in Autoregressive Video Generation via Planner-Executor RL

    Jun 26, 2026Jing Wang, Xiangxin Zhou, Jiajun Liang +5Autoregressive Video GenerationAutoregressive Diffusion

  44. MemoBench: Benchmarking World Modeling in Dynamically Changing Environments

    Jun 25, 2026Haoyu Chen, Kaichen Zhou, Hang Hua +11Long-Video BenchmarksGenerative Video Models

  45. RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation

    Jun 25, 2026Minghao Yin, Jiahao Lu, Wenbo Hu +3Video Diffusion ModelsPositional Encoding

  46. PhysRAG: Enhancing Physics-Awareness in Video Generation via Retrieval-Augmented Generation

    Jun 25, 2026Kexu Cheng, Zicheng Liu, Mingju Gao +2Video GenerationText-To-Video Generation Model

  47. NaviCache: Test-Time Self-Calibration Caching for Video Generation

    Jun 25, 2026Zheqi Lv, Zhibo Zhu, Jinke Wang +6Video GenerationAccelerometer Data

  48. LearniBridge: Learnable Calibration of Feature Caching for Diffusion Models Acceleration

    Jun 25, 2026Xuyue Huang, Zhe Chen, Wang Shen +1Diffusion TransformersDiffusion Models

  49. LiveEdit: Towards Real-Time Diffusion-Based Streaming Video Editing

    Jun 25, 2026Xinyu Wang, Chongbo Zhao, Fangneng Zhan +1Video EditingStreaming Video

  50. VPA-Guard: Defending and Benchmarking Image-to-Video Generation Against Visual Prompt Attacks

    Jun 24, 2026Yining Sun, Haoyu Kang, Jiajun Wu +7Video GenerationJailbreak Attacks

  51. Trimming the Long-Tail of Visual World Modeling Evaluation

    Jun 23, 2026Bingxuan Li, Yining Hong, Cheng Qian +6Video World ModelsWorld

  52. Navigating User Behavior toward Personalized Multimodal Generation

    Jun 23, 2026Hengji Zhou, Yufeng Liu, Ye Liu +3Multimodal GenerationData Generation Pipelines