Video Generation

Momentum

48 papers in the last four weeks, up 380% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. Autonomous Video Generation with Counterfactual Controllability for Self-Evolving World Models

    Jun 23, 2026Xin Wang, Wenxuan Liu, Tongtong Feng +1Video GenerationControllability

  2. Information-Theoretic Classifier-Free Guidance with Adaptive Schedule Optimization

    Jun 23, 2026Haobo Chen, Xiangxiang Xu, Yuheng BuClassifier-Free GuidanceDiffusion Models

  3. Towards Error-Free Long Video Generation

    Jun 21, 2026Shuning Chang, Weihua Chen, Jiasheng Tang +8Interactive Video GenerationVideo Generation

  4. CoDMD: Copula-aware Distribution Matching Distillation for Fast Video Generation

    Jun 20, 2026Wenhu Zhang, Kun Cheng, Changyuan Wang +7Video Diffusion ModelsDistribution Matching Distillation

  5. GroundShot: Visually Consistent Multi-Shot Long Video Generation via Entity-Grounded Shot Scheduling

    Jun 18, 2026Yixuan Lai, Tianjia Shao, Kun Zhou +3Interactive Video GenerationLong Video Generation

  6. TriMotion: Modality-Agnostic Camera Control for Video Generation

    Jun 18, 2026Seunghyun Shin, Jifei Song, Wooseok Jeon +2Camera ControlCamera Trajectories

  7. ImageWAM: Do World Action Models Really Need Video Generation, or Just Image Editing?

    Jun 17, 2026Yuyang Zhang, Wenyao Zhang, Zekun Qi +7World ModelsVideo Generation

  8. Cinematic Compositing Using Character-Environment-Harmonized Video Generation Models

    Jun 17, 2026Tianyi Xiang, Mingming He, Li Ma +1Video Diffusion ModelsLighting

  9. UniTemp: Unlocking Video Generation in Any Temporal Order via Bidirectional Distillation

    Jun 17, 2026Lin Zhang, Sicheng Mo, Zefan Cai +6Autoregressive Video Diffusion ModelsVideo Generation

  10. SC3-Eval: Evaluating Robot Foundation Models via Self-Consistent Video Generation

    Jun 17, 2026Wei-Cheng Tseng, Gashon Hussein, Yuzhu Dong +9Video World ModelsAutoregressive Rollout

  11. Bridging Creative Intent and Visual Quality: Creator-Driven Recurrent Video Generation with Agentic Feedback Loops

    Jun 17, 2026Denis Savytski, Aiden Lei, Heding Liu +4Video GenerationGenerative Artificial Intelligence

  12. MaineCoon: Pursuing A Real-Time Audio-Visual Social World Model

    Jun 16, 2026Lichen Bai, Tianhao Zhang, Shitong Shao +14Video World ModelsVideo Generation

  13. OmniDrive: An LLM-Choreographed Multi-Agent World Model with Unified Latent Co-Compression for Multi-View Driving Video Generation

    Jun 16, 2026Zijie Meng, Yufei Liu, Chengqian Ma +8Diffusion-Based Vision-Language-ActionsMulti-View

  14. Revealing Artifacts via Noise Amplification: A Novel Perspective for AI-Generated Video Detection

    Jun 15, 2026Renxi Cheng, Jie Gui, Hongsong WangAi-Generated Video DetectionGenerative Video Models

  15. Track2View: 4D-Consistent Camera-Controlled Video Generation via Paired 3D Point Tracks

    Jun 14, 2026Feng Qiao, Zhaochong An, Zhexiao Xiong +23D TrackingCamera Trajectories

  16. VideoWeave: Unlocking Geometric Consistency in Video Generation via Joint Geometry-Video Modeling

    Jun 12, 2026Xunzhi Xiang, Zixuan Duan, Yabo Chen +8Video Diffusion ModelsVideo Generation

  17. Avatar V: Scaling Video-Reference Avatar Video Generation

    Jun 11, 2026Benjamin Liang, Ce Chen, Desmond Lin +20Video GenerationHuman Motion Generation

  18. CineOrchestra: Unified Entity-Centric Conditioning for Cinematic Video Generation

    Jun 11, 2026Sharath Girish, Tsai-Shien Chen, Zhikang Dong +4Video Diffusion ModelsVideo Generation

  19. ReFree: Towards Realistic Co-Speech Video Generation via Reward-Free RL and Multilevel Speech Guidance

    Jun 11, 2026Salaheldin Mohamed, M. Hamza Mughal, Rishabh Dabral +1Precise Lip SynchronizationCo-Speech Gesture Generation

  20. VICX: Generalizable Robot Manipulation via Video Generation and In-Context Operator Network

    Jun 10, 2026Song Chen, Linyan Xiang, Ying Zhou +1Robotic ManipulationRobot Systems

  21. A Comprehensive Ecosystem for Open-Domain Customized Video Generation

    Jun 10, 2026Jingxu Zhang, Yuqian Hong, Daneul Kim +6Video GenerationDiffusion Transformers

  22. ARGUS: Stacked Multi-View Identity Mosaic Injection for Subject-Preserving Video Generation

    Jun 10, 2026Zijie Meng, Jiwen Liu, Yufei Liu +5Video GenerationRe-Identification

  23. Flow-DPPO: Divergence Proximal Policy Optimization for Flow Matching Models

    Jun 9, 2026Bowen Ping, Xiangxin Zhou, Penghui Qi +3Proximal Policy OptimizationOffline Reinforcement Learning

  24. Making Time Editable in Video Diffusion Transformers

    Jun 8, 2026Konstantin Kuklev, Viacheslav Vasilev, Alexander Kunitsyn +2Video GenerationTemporal Dynamics

  25. MilliVid: Hierarchical Latents for Long-Range Consistency in Video Generation

    Jun 8, 2026Ishaan Preetam Chandratreya, David Charatan, Basile Van Hoorick +4Video Diffusion ModelsVideo Generation

  26. CultureScore: Evaluating Cultural Faithfulness in Video Generation Models

    Jun 5, 2026Anku Rani, Wei Dai, Shravan Nayak +3Generative Video ModelsCultural Awareness

  27. LoomVideo: Unifying Multimodal Inputs into Video Generation and Editing

    Jun 4, 2026Jianzong Wu, Hao Lian, Jiongfan Yang +12Video GenerationLong Videos

  28. Dream.exe: Can Video Generation Models Dream Executable Robot Manipulation?

    Jun 3, 2026Rui Zhao, Kaiming Yang, Jifeng Zhu +6Generative Video ModelsHuman Motion Generation

  29. Activation Steering of Video Generation Models via Reduced-Order Linear Optimal Control

    Jun 3, 2026Jihoon Hong, Alice Chan, Qiyue Dai +2Linear Activation SteeringVideo Generation

  30. Towards 3D-Aware Video Diffusion Models: Render-Free Human Motion Control with Mesh Tokenization

    Jun 1, 2026Jingyun Liang, Min Wei, Shikai Li +5Video Diffusion ModelsVideo Generation

  31. OptiWorld: Optimal Control for Video World Generation under Physical Constraints

    May 30, 2026Yu Yuan, Jianhao Yuan, Xijun Wang +4Playable Video World GenerationVideo Generation

  32. OmniMem: Scalable and Adaptive Memory Retrieval for Long Video Generation

    May 28, 2026Lin Zhao, Yushu Wu, Yifan Gong +2Autoregressive Video GenerationLong Video Generation

  33. YoCausal: How Far is Video Generation from World Model? A Causality Perspective

    May 28, 2026You-Zhe Xie, Yu-Hsuan Li, Jie-Ying Lee +3Video Diffusion ModelsCausal Reasoning

  34. VPG: Visual Prefix Guidance for Autoregressive Image and Video Generation

    May 28, 2026Xinyao Liao, Qiyuan He, Yicong Li +4Autoregressive Image GenerationVideo Generation

  35. LiveSVG: Zero-Shot SVG Animation via Video Generation

    May 28, 2026Matan Levy, Ran Margolin, Bar Cavia +6Scalable Vector GraphicVideo Diffusion Models

  36. DirectorBench: Diagnosing Long-Form Video Generation with Personalized Multi-Agent Evaluation

    May 28, 2026Jiamin Chen, Qianben Chen, Jiawen Zhang +5Video GenerationDiagnostic Benchmark

  37. Which Pretraining Paradigm Better Serves Spatial Intelligence? An Empirical Comparison of Vision-Language and Video Generation Models

    May 27, 2026Haozhan Shen, Tiancheng Zhao, Kangjia Zhao +1Ava-VlmVideo Generation

  38. SmartDirector: Keyframe-Conditioned Cinematic Video Generation with Narrative Pacing Control

    May 27, 2026Zhida Zhang, Jie Ma, Zhan Peng +5Video GenerationDramadirector

  39. E3^3C: Video Generation with 3D Environmental Memory and Ego-Exo Human Pose Control

    May 25, 2026Qiao Gu, Lingni Ma, Adam W Harley +3Egocentric VideoCamera-Conditioned Video Generation

  40. AnyScene: Towards Highly Controllable Driving Scene Generation at Anywhere and Beyond

    May 25, 2026Haiming Zhang, Junfei Zhou, Feng Jiang +6Indoor Scene GenerationAutonomous Driving

  41. On-Policy Adversarial Flow Distillation for Autoregressive Video Generation

    May 25, 2026Yang Luo, Shengju Qian, Xiaohang Tang +4Autoregressive Video GenerationVideo Generation

  42. Paris 2.0: A Decentralized Diffusion Model for Video Generation

    May 25, 2026Ali Rouzbayani, Bidhan Roy, Marcos Villagra +1Generative Video ModelsVideo Generation

  43. PixelWizard: Towards Efficient High-Fidelity Video Generation at Ultra-Large Spatial Resolution

    May 25, 2026Wenxue Li, Jingjing Ren, Peng Zhang +4Video GenerationVisual Fidelity

  44. DeltaCam: Differential Intrinsic Camera Modeling for Video Generation

    May 24, 2026Debabrata Mandal, Zhihan Peng, Yujie Wang +1Camera ControlLong Video Generation

  45. Geo-Align: Video Generation Alignment via Metric Geometry Reward

    May 22, 2026Zizun Li, Haoyu Guo, Runzhe Teng +2Video GenerationGeogs-Slam

  46. LaMo: Self-Supervised Latent Motion Priors for Physical Realism in Video Generation

    May 22, 2026Bo Jiang, Depu Meng, Yihan Hu +3Video GenerationLatent Motion

  47. VDE: Training-Free Accelerating Rectified Flow Model via Velocity Decomposition and Estimation

    May 22, 2026Junwen Tan, Jinglin Liang, Hongyuan Chen +1Rectified FlowConditional Velocity

  48. CoMoGen: COntrollable MOtion Dynamics and Interactions with Mask-Guided Video GENeration

    May 21, 2026Adil Meric, Lin Geng Foo, Mert Kiray +3Human Motion GenerationVideo Generation

  49. MotiMotion: Motion-Controlled Video Generation with Visual Reasoning

    May 21, 2026Lee Hsin-Ying, Hanwen Jiang, Yiqun Mei +3Human Motion GenerationVideo Generation

  50. Bernini: Latent Semantic Planning for Video Diffusion

    May 21, 2026Bernini Team, Chenchen Liu, Junyi Chen +9Video Multimodal Large Language ModelsVideo Generation

  51. One Sentence, One Drama: Personalized Short-Form Drama Generation via Multi-Agent Systems

    May 21, 2026Yufei Shi, Weilong Yan, Naixuan Huang +5Video GenerationCross-Modal

  52. Dynamic Video Generation: Shaping Video Generation Across Time and Space

    May 20, 2026Shikang Zheng, Jingkai Huang, Jiacheng Liu +5Video Generation

  53. DySink: Dynamic Frame Sinks for Autoregressive Long Video Generation

    May 20, 2026Bo Ye, Xinyu Cui, Jian Zhao +2Autoregressive Video GenerationVideo Generation

  54. CogOmniControl: Reasoning-Driven Controllable Video Generation via Creative Intent Cognition

    May 19, 2026Hongji Yang, Songlian Li, Yucheng Zhou +4Video GenerationCogadapt