Video Generation

Momentum

48 papers in the last four weeks, up 380% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 238

All topics
CardsList
  1. HiPhy: Hierarchical Alignment for Physically-Plausible Multi-Principle Video Generation

    Oct 1, 2026Tahira Kazimi, Shubhankar Borse, Munawar Hayat +2Video Generation

  2. MosaiChunk: Compositing Spatio-Temporal Memory for Autoregressive Video Generation

    Oct 1, 2026Yiwen Zhang, Haocheng Xi, Michael Tian-Yue Liu +4Autoregressive Video GenerationVideo Generation

  3. Memory-Guided B-Roll Generation from User Video Collections

    Oct 1, 2026Cusuh Ham, Fabian Caba Heilbron, Josef Sivic +1Long Video GenerationVideo Generation

  4. DiVid: Diagnosing Dimension-Specific Diversity Collapse in Video Generation Models

    Oct 1, 2026Huanran Hu, Zihui Ren, Dingyi Yang +4Diversity CollapseVideo Generation

  5. VTR-Bench: A Systematic Benchmark for Evaluating Visual Text Rendering in Video Generation

    Oct 1, 2026Yu Huang, Jungang Li, Zhiyuan Wang +8Text-To-Video Generation ModelVideo Generation

  6. PhysicsLENS: Diagnosing Physical Property Blindness in Video Generation Models

    Oct 1, 2026Isaiah Milkey, Som Sagar, Aditya Taparia +3Physical PlausibilityGenerative Video Models

  7. Ego2Act: Evaluating Goal-Directed Manipulation in Egocentric Video Generation

    Oct 1, 2026Patrick Amadeus Irawan, Iskandar Muda Rizky Parlambang, Rava Maulana +10Egocentric VideoVideo Generation

  8. Towards Subject Consistency over Dynamic Subject Sets in Video Generation

    Oct 1, 2026Tongcheng Zhang, Jun Zhu, Jianfei ChenVideo GenerationSubjectivity

  9. Video Generation Models: A Survey of Post-Training and Alignment

    Sep 30, 2026Chaoyu Li, Xiaoyi Gu, Yogesh Kulkarni +10Generative Video ModelsVideo Generation

  10. Soundwich: Video Generation with Layered and Controllable Audio

    Sep 30, 2026Zhuo Ning, AmirHossein Naghi Razlighi, Sagi Polaczek +2Audio-Video GenerationVideo Generation

  11. SemanTok: Predictable Semantic Tokens for Efficient Autoregressive Video Generation

    Sep 30, 2026Mikhail Dereviannykh, Vikram Voleti, Simon Donne +3Visual TokenizersAutoregressive Video Generation

  12. VR-JEPA: Learning Contrastive-State Latent Guidance for Generation-based Video Reasoning

    Sep 30, 2026Zehua Ma, Kun Xiang, Yunshuang Nie +9Latent Visual ReasoningVideo Generation

  13. Enhancing Autoregressive Video Generation via Representation Adversarial Distillation

    Sep 30, 2026Fangyu Lin, Xingtong Ge, Lunjie Zhu +8Autoregressive Video GenerationVideo Generation

  14. PartiCam: Camera Controlled Video Generation with Reward Guidance

    Sep 30, 2026Amine Ouasfi, Runjia Li, Junlin Han +3Camera TrajectoriesVideo Diffusion Models

  15. PARK: Accurate Block Retrieval for Sparse Attention in Video Diffusion Transformers

    Sep 30, 2026Yun Dai, Jiarui Wen, Huiping Zhuang +2Video Generation

  16. FrameMorrow: Future-guided Frame Selection with Prospective Tokens for Long-Horizon Video Generation

    Sep 30, 2026Bo Yin, Xiaobin Hu, Jiaqi Zhao +1Long Video GenerationVideo Generation

  17. No Corners Cut: State-Grounded Transitions for Mid-Stream Prompt Switches in Video Generation

    Sep 30, 2026Zejing Rao, Ketong Ren, Xiaoqiang Liu +3Video GenerationTransitions

  18. EPIC: Epipolar-Consistent 360° Immersive Stereo Video Generation

    Sep 30, 2026Debabrata Mandal, Dongdong Fu, Jonathon Miller +3Video GenerationVideo Diffusion Models

  19. Counterfactual Video Generation Enables Scalable Humanoid Loco-Manipulation

    Sep 29, 2026Zihan Wang, Zhen Wu, Pieter Abbeel +6Motion ImitationCamera-Conditioned Video Generation

  20. LIFT: Layout-In-Future Video Generation under Large Viewpoint Change via On-Policy Self-Distillation

    Sep 29, 2026Shengxiang Ji, Boyang Wang, Haiyang Xu +9Long Video GenerationVideo Generation

  21. Learning via Self-Consistency for Diffusion-based Video Reasoning

    Sep 29, 2026Zhenghao Ni, Weimin Qiu, Meng TangVideo GenerationSelf-Consistency

  22. Scaling Video Generation for Reasoning: At What Cost?

    Sep 29, 2026Weihang Guo, Xiaoyu Wu, Yifei Wang +2Generative Video ModelsLong Video Generation

  23. PreviewDiff: Multimodal Critic-Guided Search over Diffusion Latents

    Sep 28, 2026Vighnesh Subramaniam, Boris Katz, Brian Cheung +3Diffusion SamplingVideo Generation

  24. CoDrive: Cross-Vehicle World-Consistent Video Generation with Precise Trajectory Control for Cooperative Driving

    Sep 28, 2026Yu Meng, Baining Zhao, Junta Wu +10DrivesCamera Trajectories

  25. Geometry as Address: Routing Attention to Visual Memory for Long-Horizon Camera-Controlled Video Generation

    Sep 28, 2026Zesong Yang, Weikai Chen, Liyuan Cui +10Camera TrajectoriesVideo Generation

  26. TSGate: Timestep-Aware Gated Attention for Diffusion Transformers

    Sep 28, 2026Boyu Zhang, Yifan Liu, Shuxia Lin +3Diffusion TransformersVideo Generation

  27. MaLiang-Harness: A Programmable Path to Image and Video Generation

    Sep 28, 2026Haoyu Zhao, Zihao Zhang, Xudong Wang +4Visual GenerationVideo Generation

  28. WorldWeave: Growing Persistent Geometric Worlds for Video Generation

    Sep 28, 2026Yifan Huang, Lifan Jiang, Qingyue Hao +5Playable Video World GenerationVideo Generation

  29. WanPE: Towards Cinematic Prompt Enhancement for Modern Text-to-Video Generation

    Sep 24, 2026Yubo Zhu, Yawen Shao, Ziyun Dai +27Video Generation

  30. Training Object Permanence in World Models

    Sep 23, 2026Haotian Zhang, Fengyuan Yu, Dezhi Luo +28Video World ModelsWorld Models

  31. QuantWM: Temporally Consistent 2-Bit KV Cache Quantization for Video World Models

    Sep 22, 2026Jiaqi Zhao, Xiaobin Hu, Bo Yin +3Key-Value Cache QuantizationQantis

  32. VideoGen-Agent: Reinforcing Video Generation Agents

    Sep 21, 2026Binxu Li, Haoyi Duan, Yuhui Zhang +9Video AgentVideo Generation

  33. Video DeltaNet: A Video-Native Hybrid Attention for Livestream Video Generation

    Sep 17, 2026Haocheng Xi, Yiming Xie, Hexu Zhao +8Video Diffusion ModelsVideo Generation

  34. PhysStream: Streaming Physics-Grounded Video Generation with Structured Scene Memory and Fine-Grained Motion Control

    Sep 15, 2026Chuhao Chen, Peter Wonka, Chaoyang Wang +4Video GenerationIndoor Scene Generation

  35. SlotDiT: Object-Centric Representations for Diffusion Transformers

    Sep 15, 2026Gjergj Plepi, Sven BehnkeDiffusion TransformersVideo Generation

  36. VC-Attention: Value Smoothing and Softmax Casting for Low-bit Attention

    Sep 14, 2026Xingyang Li, Dongyun Zou, Shining Zhang +8Linear AttentionVideo Generation

  37. AgenticGen: Reward-Guided Agentic Video Generation for Advertising

    Sep 10, 2026Xingyuan Bu, Chengru Song, Hao Zhou +9Video AgentAds

  38. Temporal State Transport in Video Generation: Diagnosing and Correcting Spectral Imbalance

    Sep 8, 2026Luyao Tang, Bingjun Luo, Dong Yi +5Video GenerationSpectral

  39. PhysFlow: Physics-Aware Optical Flow for Motion Controllable Video Generation

    Sep 8, 2026Cong Wang, Hanxin Zhu, Yonglin Tian +5Video GenerationOptical Flow

  40. Geodesic-informed Generative Diffusion Model For Topology-preserved Image Video Generation

    Sep 8, 2026Nian Wu, Nivetha Jayakumar, Jiarui Xing +1Diffusion Models3D Generative Models

  41. The Price of Consistency: Exploiting Visual Anchors for Multimodal Jailbreaking in Video Generation

    Sep 7, 2026Peng Li, Qianqian Xu, Yangbangyan Jiang +2Generative Video ModelsVideo Generation

  42. Do Video Generators Track the World Across Segments? A Benchmark and Method for World-State Reasoning in Video Continuation

    Sep 3, 2026Yingmao Miao, Pengfei Zhang, Chaoran Xu +5Video GenerationContinuation

  43. Building Pretraining Data for World Models: An Unreal Engine-Based Pipeline for Action-Conditioned Video Generation

    Sep 3, 2026Haoyu Wang, Songchun Zhang, Haoran Li +3Camera-Conditioned Video GenerationVideo Generation

  44. Physically Plausible Video Generation via Visual-Semantic Chain-of-Events Conditioning

    Sep 1, 2026Zixuan Wang, Yixin Hu, Wen Li +4Camera-Conditioned Video GenerationLong Video Generation

  45. DramaChain Bench: An End-to-End Benchmark for Short-Drama Generation

    Sep 1, 2026Haoyuan Shi, Mingtao Chen, Shuo Jiang +12Cinematic IdealVideo Generation

  46. CineForge: Self-Improving Agents for Long-Horizon Video Generation

    Aug 30, 2026Junxiang Liu, Lin Wang, Haiyu Shi +10Video AgentVideo Generation

  47. GeoFlow: Efficient Driving Video Generation via Geometry-Aligned Priors

    Aug 12, 2026Jiazheng Liu, Hang Li, Jiawei Zhang +5Video GenerationGenerative Models

  48. Stream Forcing: Constructing Unified Training Trajectory for Robust Streaming Video Generation

    Aug 11, 2026Yueting Zhu, Yuehao Song, Kaicheng Zhang +5Video Diffusion ModelsVideo Generation

  49. DUET: A Diversity-Quality Duet of Distillation Experts for Two-Step Video Generation

    Aug 10, 2026Zian Li, Litong Gong, Borui Liao +6Video GenerationSymbolic Distillation

  50. RAVEN-Eval: Rubric-Guided Automatic Evaluation for AI Video Generation Models Based on LMM Preference Judgement

    Aug 10, 2026Ziheng Jia, Jiaying Qian, Zicheng Zhang +3Generative Video ModelsVideo Generation

  51. LogiShot: Logically Coherent Cross-Shot Video Generation

    Aug 9, 2026Shuai Guo, Yuhang Yang, Zeyu Zhang +4Interactive Video GenerationVideo Generation

  52. Diff-VF: Training-free High-quality Long Video Generation via Diffusion Model

    Aug 6, 2026Haoning Yang, Xinyuan Chen, Yaohui Wang +1Video Diffusion ModelsInteractive Video Generation