Text-to-Video Generation

Latest papers 65

All topics
CardsList
  1. SkillPE: Creativity-Oriented Cinematic Skill Evolution for Text-to-Video Prompt Engineering

    Sep 28, 2026Yanwei Huang, Mingxuan Zhu, Shujie Li +3Text-to-Video GenerationVideo Generation

  2. WanPE: Towards Cinematic Prompt Enhancement for Modern Text-to-Video Generation

    Sep 24, 2026Yubo Zhu, Yawen Shao, Ziyun Dai +27Text-to-Video GenerationLong Video Generation

  3. MotionSpec: Spectral Trajectory Supervision for Motion-Consistent Video Generation

    Sep 23, 2026Ziqi Ni, Rui Li, Shiqi Jiang +1Text-to-Video GenerationTemporal Consistency in Video Generation

  4. CompAdapt: Adaptable Composite Motion Modeling for Physics-Consistent Text-to-Video Generation

    Sep 18, 2026Haoran Qin, Renlong Wu, Tianyu Huang +3Physical Consistency in Video GenerationText-to-Video Generation

  5. Better Call CineCrew: Consistent Ultra-Long Narrative-to-Film Generation

    Sep 7, 2026Jiaben Chen, Sixun Dong, Qinhong Zhou +4Text-to-Video GenerationLong Video Generation

  6. DF26: We Cannot Tell Fake From Real Anymore

    Sep 7, 2026Severyn Shykula, Andrii Yermakov, Ivan Samarskyi +3Text-to-Video GenerationOOD Generalization

  7. NoisEasier: Test-Time Noise Optimization for Text-to-Video Generation

    Aug 31, 2026Yujiang Pu, Yu KongDiffusion Model GuidanceVideo Diffusion Models

  8. HPSD: Hybrid-Policy Self-Distillation for Text-Image-to-Video Diffusion Models

    Aug 13, 2026Jiazi Bu, Pengyang Ling, Yujie Zhou +10Image-to-Video GenerationVideo Diffusion Models

  9. Spatially-Grounded Text-to-Video Generation via Inference-Time Gradient-Free Optimization

    Aug 13, 2026Guillaume Jeanneret, Mathis Koroglu, Hugo Caselles-Dupré +2Diffusion TransformerText-to-Video Generation

  10. From Cheap Fakes to Pure Synthesis: Addressing the New Era of T2V Fake News Videos

    Aug 7, 2026Yifeng Luo, Yupeng Li, Liang Lan +1Fake News DetectionText-to-Video Generation

  11. EmoWorld: A Decoupled Affective Field for Controllable Emotional Video Generation

    Aug 6, 2026Bingyuan Wang, Baistan Zhyldyzbekov, Kunyu Feng +1Image-to-Video GenerationVideo Diffusion Models

  12. Vorch-Streamer: Extending Human Audio-Visual Generation to Real-Time Long-Form Streaming

    Aug 6, 2026Menglin Han, Yang Ding, Yulei Lu +6Text-to-Video GenerationLong-Horizon Video Generation

  13. CultureVidBench: Benchmarking Cultural Understanding in Text-to-Video Generation

    Aug 3, 2026Xianjing Han, Yuhan Su, Yang Deng +3Text-to-Video GenerationVideo Generation

  14. Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion

    Jul 30, 2026Henglin Liu, Fangyuan Kong, Jing Wang +7Diffusion Model AlignmentVideo Diffusion Models

  15. TPD: Temporal Prior Decoupling for Text-to-Video Diffusion Models

    Jul 29, 2026Taewon Kang, Matthias ZwickerDiffusion Model GuidanceVideo Diffusion Models

  16. FilmBench: A Film-Grade Benchmark for Cinematic Video Generation

    Jul 27, 2026Shengyi Wang, Niantong Li, Guangzheng Hu +27Video-Reference Video GenerationText-to-Video Generation

  17. GroupVideo: Multi-Identity Customized Text-to-Video Generation

    Jul 23, 2026Xinyang Song, Libin Wang, Jianxin Sun +4Video Diffusion ModelsText-to-Video Generation

  18. FilmWorld: Agentic Novel-to-Film Generation through Dynamic Cinematic World Modeling

    Jul 21, 2026Jialong Zuo, Haotong Zuo, Shiwei Zhang +5Text-to-Video GenerationLong Video Generation

  19. Moving Alphabet: A Controlled Study of Training Data for Text-to-Video Generation

    Jul 21, 2026Amber Yijia Zheng, Lu Liu, Raymond A. Yeh +1Text-to-Video Generation

  20. Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation

    Jul 20, 2026Zhenjie Liu, Binyan Chen, Hao Chen +2Action-Conditioned Video GenerationText-to-Video Generation

  21. Your Data Manifold is Secretly a Reward Model: Shell-LCC for Text-to-Video Generation

    Jun 29, 2026Shihao Zhang, Yunzhi Li, Yuguang Yan +4Reward ModelingDiffusion Model Guidance