Text-To-Video Diffusion Models

Latest papers 38

All topics
CardsList
  1. Texture Space Material Diffusion

    Sep 29, 2026Jacob Munkberg, Peter Kocsis, Jon HasselgrenText-To-Video Diffusion ModelsTexture

  2. Motion Concept Unlearning in Video Diffusion Models

    Sep 29, 2026Ping Liu, Chi ZhangText-To-Video Diffusion ModelsVideo Diffusion Models

  3. CompAdapt: Adaptable Composite Motion Modeling for Physics-Consistent Text-to-Video Generation

    Sep 18, 2026Haoran Qin, Renlong Wu, Tianyu Huang +3Text-To-Video Generation ModelText-To-Video Diffusion Models

  4. CrossDistill: Balancing Quality and Diversity via Trajectory-Level Hybrid Few-Step Distillation

    Sep 13, 2026Yuxi Liu, Haoyu Li, Yixiang Cai +8Few-Step DistillationText-To-Video Diffusion Models

  5. EraseSAE: Surgical Concept Erasure in Text-to-Video Diffusion Models via Sparse Autoencoders

    Sep 3, 2026Xinghao Wang, Dong Li, Wei Yu +5Concept ErasureText-To-Video Diffusion Models

  6. HPSD: Hybrid-Policy Self-Distillation for Text-Image-to-Video Diffusion Models

    Aug 13, 2026Jiazi Bu, Pengyang Ling, Yujie Zhou +10Text-To-Video Diffusion ModelsText-To-Video Generation Model

  7. Spatially-Grounded Text-to-Video Generation via Inference-Time Gradient-Free Optimization

    Aug 13, 2026Guillaume Jeanneret, Mathis Koroglu, Hugo Caselles-Dupré +2Text-To-Video Diffusion ModelsTransformer Architectures

  8. Erase but Preserve: Controllable Removal of Copyrighted Animation Characters via Optimized Semantic Anchors

    Aug 13, 2026Qiao Li, Xiaomeng Fu, Wangjia Yu +4Text-To-Image Diffusion ModelsConcept Erasure

  9. Visual Representation Matters: Exploiting Temporal Differences in Video-to-Audio Generation

    Aug 5, 2026Zehua Chen, Junyou Wang, Yuxuan Jiang +5Audio-Video GenerationText-To-Video Diffusion Models

  10. Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion

    Jul 30, 2026Henglin Liu, Fangyuan Kong, Jing Wang +7Text-To-Video Diffusion ModelsVideo Diffusion Models

  11. TPD: Temporal Prior Decoupling for Text-to-Video Diffusion Models

    Jul 29, 2026Taewon Kang, Matthias ZwickerText-To-Video Diffusion ModelsDiffusion Models

  12. CineWeaver: Training-Free Reference-Controllable Multi-Shot Long Video Generation for Cinematic Storytelling

    Jul 29, 2026Yuyang Huang, Yabo Chen, Wenrui Dai +6Interactive Video GenerationText-To-Video Diffusion Models

  13. OSVE: One Step Video Editing with One Step Diffusion Models

    Jul 22, 2026Habin Lim, Gyeong-Moon ParkText-To-Video Diffusion ModelsVideo Editing

  14. MotionForesight: Re-purposing Video Models for Future 3D Scene-Flow Prediction

    Jul 17, 2026Homanga Bharadhwaj, Yash JangirHuman Motion PredictionFuture Video Prediction

  15. Retrieving and Refining Winning Noise Tickets for Diffusion-Based Motion Generation

    Jul 7, 2026Sakuya Ota, Qing Yu, Kent Fujiwara +2Text-To-Motion GenerationHuman Motion Generation

  16. Prompt-Adapter Context Routing for Parameter-Efficient Multi-Shot Long Video Extrapolation

    Jul 7, 2026Anna Córdoba, Adam Puente Tercero, Nerea Angulo Hijo +4Text-To-Video Diffusion ModelsLong-Video Benchmarks

  17. FADRA: Frequency-Aware Diffusion with Residual Adaptation for Video Face Restoration

    Jul 7, 2026Jin Jiang, Jia Wang, Panwen Hu +2Video RestorationBlind Face Restoration

  18. ICDepth: Taming Video Diffusion Models for Video Depth Estimation via In-Context Conditioning

    Jul 2, 2026Xuanhua He, Jiaxin Xie, Mingzhe Zheng +1Monocular Depth EstimationVideo Diffusion Models

  19. Vera: A Layered Diffusion Model for Content-Preserving Video Editing

    Jun 22, 2026Hongkai Zheng, Ta-Ying Cheng, Benjamin Klein +2Text-To-Video Diffusion ModelsVideo Editing

  20. CausalMotion: Structured Physical Reasoning as Keyframe and Trajectory Guidance for Training-Free Video Generation

    Jun 12, 2026Sihan Zhuang, Xinyuan Chen, Tianfan Xue +1Text-To-Video Diffusion ModelsHuman Motion Generation

  21. GenEraser: Generalizable Video Object Removal via Balanced Text-Mask Guidance and Decoupled Locator-Preserver

    May 28, 2026Yuqing Chen, Lin Liu, Haisu Wu +4Video Object RemovalText-To-Video Diffusion Models

  22. KGEdit: Ambiguity-Aware Knowledge Graphs for Training-Free Precise Video Generation and Editing

    May 28, 2026Mingshu Cai, Miao Zhang, Chenghe Yang +3Text-To-Video Diffusion ModelsInteractive Video Generation

  23. Sketch2Motion: Text-driven 2D Sketch to 3D Animation via Diffusion-guided Skeleton Optimization

    May 27, 2026Gaurav Rai, Ojaswa SharmaSkeletonSketches

  24. Where Concept Erasure Should Occur: Concept-Layer Alignment in Text-to-Video Diffusion Models

    May 25, 2026Yiwei Xie, Ping Liu, Zheng ZhangText-To-Video Diffusion ModelsConcept Erasure

  25. GeoFlow: Enforcing Implicit Geometric Consistency in Video Generation

    May 18, 2026Jan Ackermann, Shengqu Cai, Boyang Deng +3Generative Video ModelsText-To-Video Diffusion Models

  26. Temporal Aware Pruning for Efficient Diffusion-based Video Generation

    May 18, 2026Sheng Li, Yang Sui, Junhao Ran +3Text-To-Video Diffusion ModelsVisual Token Pruning

  27. Image-to-Video Diffusion: From Foundations to Open Frontiers

    May 17, 2026Xianlong Wang, Wenbo Pan, Shijia Zhou +6Text-To-Video Diffusion ModelsLong Video Generation

  28. Video Reconstruction using Diffusion-based Image-to-Video Generation with Trajectory Guidance

    May 14, 2026Stelio Bompai, Ioannis Kontopoulos, Giannis Spiliopoulos +2Text-To-Video Diffusion ModelsRtk-Gnss

  29. Reconstruction-Anchored Diffusion Model for Text-to-Motion Generation

    Jan 21, 2026Yifei Liu, Changxing Ding, Ling Guo +2Text-To-Motion GenerationText-To-Video Diffusion Models

  30. GRAN-TED: Generating Robust, Aligned, and Nuanced Text Embedding for Diffusion Models

    Dec 17, 2025Bozhou Li, Sihan Yang, Yushuo Guan +6Text-To-Video Diffusion ModelsText-To-Image

  31. Unified Long Video Inpainting and Outpainting via Overlapping High-Order Co-Denoising

    Nov 5, 2025Shuangquan Lyu, Jian Mao, Yue MaText-To-Video Diffusion ModelsLong Video Generation

  32. AnyView: Synthesizing Any Novel View in Dynamic Scenes

    Date pendingBasile Van Hoorick, Dian Chen, Shun Iwase +7Generative Video ModelsNovel View Synthesis