Text-to-Video Generation

Latest papers 65

All topics
CardsList
  1. A Good Talk Does not Look Like a Summary, It Teaches You! Measuring Takeaways from Paper-to-Video Talks

    Jun 26, 2026Ishani Mondal, Aparna Garimella, Ananya Sai +2Text-to-Video GenerationScientific Communication

  2. DomainShuttle: Freeform Open Domain Subject-driven Text-to-video Generation

    Jun 24, 2026Nan Chen, Yiyang Cai, Rongchang Xie +7Text-to-Video GenerationControllable Video Generation

  3. DramaDirector: Geometry-Guided Short Drama Generation

    Jun 23, 2026Hengji Zhou, Sijie Liu, Jianrun Chen +3Text-to-Video GenerationVideo Generation

  4. Customizing Video Portraits via Identity-ActionDecoupling

    Jun 21, 2026Junxiong Lin, Haoran Wang, Xinji Mai +4Text-to-Video GenerationIdentity-Preserving Video Generation

  5. ChronoLock: Protecting Videos from Unauthorized Text-to-Video Personalization

    Jun 19, 2026Jiaming He, Jiashu Zhang, Guanyu Hou +4Video Diffusion ModelsText-to-Video Generation

  6. SpecLoR: Spectral Lookahead Rectification for Motion-Coherent Text-to-Video Generation

    Jun 10, 2026Xu Zhang, Yu Lu, Ruijie Quan +3Physical Consistency in Video GenerationText-to-Video Generation

  7. Plan-and-Verify Video Reward Reasoning with Spatio-Temporal Scene Graph Grounding

    Jun 10, 2026Hyomin Kim, Junghye Kim, Joanie Hayoun Chung +4Reward ModelingText-to-Video Generation

  8. CineDance: Towards Next-Generation Multi-Shot Long-Form Cinematic Audio-Video Generation

    Jun 8, 2026Yuheng Chen, Teng Hu, Yuji Wang +7Audio-Video GenerationText-to-Video Generation

  9. Temporally Consistent and Controllable Video Generation of 2D Cine CMR via Latent Space Motion Modeling

    Jun 8, 2026Yiheng Cao, Gustavo Andrade-Miranda, Jiatian Zhang +2Latent Dynamics ModelingText-to-Video Generation

  10. Activation Steering of Video Generation Models via Reduced-Order Linear Optimal Control

    Jun 3, 2026Jihoon Hong, Alice Chan, Qiyue Dai +2Text-to-Video GenerationVideo Generation

  11. Spatial-Temporal Decoupled Reference Conditioning for Identity-Preserving Text-to-Video Generation

    Jun 1, 2026Yuheng Chen, Teng Hu, Yuji Wang +3Diffusion Model GuidanceVideo Diffusion Models

  12. SafeGen-Bench: Benchmarking Safety in Image-Conditioned Text-to-Video Generation

    May 31, 2026Yingzi Ma, Xiaogeng Liu, Yawen Zheng +1Image-to-Video GenerationText-to-Video Generation

  13. Knowledge-Intensive Video Generation

    May 31, 2026Chenxu Wang, Mingda ChenText-to-Video GenerationVideo Generation

  14. TunerDiT: Training-free Progressive Steering of Diffusion Transformer for Multi-Event Video Generation

    May 29, 2026Ruotong Liao, Guowen Huang, Qing Cheng +6Diffusion TransformerText-to-Video Generation

  15. KGEdit: Ambiguity-Aware Knowledge Graphs for Training-Free Precise Video Generation and Editing

    May 28, 2026Mingshu Cai, Miao Zhang, Chenghe Yang +3Video Diffusion ModelsText-to-Video Generation

  16. OSP-Next: Efficient High-Quality Video Generation with Sparse Sequence Parallelism, HiF8 Quantization, and Reinforcement Learning

    May 27, 2026Yunyang Ge, Xianyi He, Zezhong Zhang +4Video Diffusion ModelsText-to-Video Generation

  17. Proprio: Latent Self-Scoring and Inference-Time Refinement for Physically Plausible Video Generation

    May 27, 2026Mariam Hassan, Kaouther Messaoud, Wuyang Li +1Physical Consistency in Video GenerationImage-to-Video Generation

  18. Paris 2.0: A Decentralized Diffusion Model for Video Generation

    May 25, 2026Ali Rouzbayani, Bidhan Roy, Marcos Villagra +1Video Diffusion ModelsText-to-Video Generation

  19. MAVEN A Multi-Agent Framework for Multicultural Text-to-Video Generation

    May 16, 2026Shuowei Li, Yuming Zhao, Parth Bhalerao +1Text-to-Video GenerationMulti-Agent Systems

  20. Compositional Video Generation via Inference-Time Guidance

    May 14, 2026Ariel Shaulov, Eitan Shaar, Amit Edenzon +2Diffusion Model GuidanceVideo Diffusion Models

  21. FaithfulFaces: Pose-Faithful Facial Identity Preservation for Text-to-Video Generation

    May 6, 2026Yuanzhi Wang, Xuhua Ren, Jiaxiang Cheng +7Text-to-Video GenerationIdentity-Preserving Video Generation

  22. TrajShield: Trajectory-Level Safety Mediation for Defending Text-to-Video Models Against Jailbreak Attacks

    May 3, 2026Quanchen Zou, Nizhang Li, Wenxin Zhang +4Text-to-Video Generation

  23. World-R1: Reinforcing 3D Constraints for Text-to-Video Generation

    Apr 27, 2026Weijie Wang, Xiaoxuan He, Youping Gu +9Physical Consistency in Video GenerationText-to-Video Generation

  24. BRITE: A Benchmark for Reliable and Interpretable T2V Evaluation on Implausible Scenarios

    Apr 24, 2026Advait Tilak, Jiwon Choi, Nazifa Mouli +1Text-to-Video GenerationAudio-Visual Alignment

  25. KD-CVG: A Knowledge-Driven Approach for Creative Video Generation

    Apr 23, 2026Linkai Liu, Wei Feng, Xi Zhao +9Multimodal RAGText-to-Video Generation

  26. TS-Attn: Temporal-wise Separable Attention for Multi-Event Video Generation

    Apr 21, 2026Hongyu Zhang, Yufan Deng, Zilin Pan +6Image-to-Video GenerationText-to-Video Generation

  27. Training and Agentic Inference Strategies for LLM-based Manim Animation Generation

    Apr 20, 2026Ravidu Suien Rammuni Silva, Ahmad Lotfi, Isibor Kennedy Ihianle +2RL for Code GenerationText-to-Video Generation

  28. FlowC2S: Flowing from Current to Succeeding Frames for Fast and Memory-Efficient Video Continuation

    Apr 19, 2026Hovhannes Margaryan, Quentin Bammey, Christian SandorFlow MatchingText-to-Video Generation

  29. Generative Refinement Networks for Visual Synthesis

    Apr 14, 2026Jian Han, Jinlai Liu, Jiahuan Wang +2Text-to-Video GenerationT2I Generation