Temporal Consistency in Video Generation

Latest papers 224

All topics
CardsList
  1. Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion

    Jul 30, 2026Henglin Liu, Fangyuan Kong, Jing Wang +7Diffusion Model AlignmentVideo Diffusion Models

  2. LeapTalk: Breaking the Latency-Quality Trade-off in Talking Head Generation

    Jul 29, 2026Rongxiang Zhang, Songhua LiuAudio-Video GenerationDiffusion Model Distillation

  3. TPD: Temporal Prior Decoupling for Text-to-Video Diffusion Models

    Jul 29, 2026Taewon Kang, Matthias ZwickerDiffusion Model GuidanceVideo Diffusion Models

  4. OmniMate: Open-Ended Real-Time Streaming Audio-Visual Generation for Interactive Avatars

    Jul 25, 2026Quanyue Song, Yishan He, Yanbo Ding +4Audio-Video GenerationReal-Time Interactive Video Generation

  5. TRaM-VSR: Importance-Aware Token Routing and Merging for One-Step Diffusion Video Super-Resolution

    Jul 24, 2026Sicheng Gao, Zhuyun Zhou, Yixuan Liu +3Diffusion TransformerVideo Super-Resolution

  6. Self Gradient Forcing: Native Long Video Extrapolation

    Jul 22, 2026Junhao Zhuang, Shiyi Zhang, Yuxuan Bian +11Video Diffusion ModelsAutoregressive Diffusion

  7. OSVE: One Step Video Editing with One Step Diffusion Models

    Jul 22, 2026Habin Lim, Gyeong-Moon ParkVideo EditingInstruction-Based Video Editing

  8. FilmWorld: Agentic Novel-to-Film Generation through Dynamic Cinematic World Modeling

    Jul 21, 2026Jialong Zuo, Haotong Zuo, Shiwei Zhang +5Text-to-Video GenerationLong Video Generation

  9. Keyframe-Anchored Identity Preservation for Sequential-Action Video Generation

    Jul 20, 2026Zhenjie Liu, Binyan Chen, Hao Chen +2Action-Conditioned Video GenerationText-to-Video Generation

  10. ShotPlan: Cinematic Video Generation with Learnable Planning Token

    Jul 20, 2026Su Guo, Guangce Liu, Haosen Yang +7Video Diffusion ModelsVideo Generation

  11. Test-Time Noise Guided Adaptation for Realistic Autoregressive Video Generation

    Jul 17, 2026Dimitrios Karageorgiou, Symeon Papadopoulos, Ioannis Kompatsiaris +1Diffusion Model GuidanceVideo Diffusion Models

  12. Hallo4D: Multi-Modal Hallucination Mitigation for Consistent Spatio-Temporal Generation

    Jul 14, 2026Hongbo Wang, Huaibo Huang, Jie Cao +3Multi-View Consistency3D Scene Generation

  13. The GEST-Engine: From Event Graphs to Synthetic Video. A Full Technical Report

    Jul 14, 2026Nicolae Cudlenco, Mihai Masala, Marius LeordeanuGraph GenerationVideo Generation

  14. Cycle-World: Mitigating Error Accumulation in Long-term Video World Models via Reverse-Prediction Cycle Consistency

    Jul 13, 2026Zihan Su, Teng Hu, Jiangning Zhang +4Video Diffusion ModelsLong-Horizon Video Generation

  15. SAGA: Stable Acceleration Guidance for Autoregressive Video Generation

    Jul 9, 2026Thanh-Nhan Vo, Trong-Thuan Nguyen, Trung-Hoang Le +2Video Diffusion ModelsAutoregressive Diffusion

  16. LightCrafter: PBR-Conditioned Video Diffusion Refinement for Controllable and Consistent Relighting

    Jul 9, 2026Zixin Guo, Yehonathan Litman, Yifeng He +3Physical Consistency in Video GenerationVideo Diffusion Models

  17. Unlocking Temporal Generalization in Hamiltonian Video Dynamics Models

    Jul 8, 2026Eli Laird, Corey ClarkPhysical Consistency in Video GenerationLatent Dynamics Modeling

  18. Prompt-Adapter Context Routing for Parameter-Efficient Multi-Shot Long Video Extrapolation

    Jul 7, 2026Anna Córdoba, Adam Puente Tercero, Nerea Angulo Hijo +4Video Diffusion ModelsVideo Prediction

  19. DriveWeaver: Point-Conditioned Video Inpainting for Controllable Vehicle Insertion in Autonomous Driving Simulation

    Jun 30, 2026Junzhe Jiang, Zipei Ma, Zijie Pan +1Synthetic Data AugmentationAutonomous Driving

  20. MemLearner: Learning to Query Context memory for Video World Models

    Jun 30, 2026Jiwen Yu, Jianxiong Gao, Jianhong Bai +7Action-Conditioned Video GenerationLong-Horizon Video Generation

  21. InfiniVerse: Occupancy Guided Unbounded Scene Generation for Autonomous Driving

    Jun 30, 2026Xiaoyu Ye, Leheng Li, Xinyu Ji +8Long-Horizon Video Generation3D Scene Generation

  22. HorizonRelight: Relighting Long-horizon Videos Consistently via Diffusion Transformers

    Jun 27, 2026Jing Yang, Mayoore Jaiswal, Zian Wang +4Video EditingTemporal Consistency in Video Generation

  23. ViPSim: Collaborating Visual and Parameter Spaces for Consistent Long-Horizon Embodied World Models

    Jun 27, 2026Longyu Chen, Heng Li, Wei Yang +2Action-Conditioned Video GenerationWorld Models for Robotics

  24. TempAct: Advancing Temporal Plausibility in Autoregressive Video Generation via Planner-Executor RL

    Jun 26, 2026Jing Wang, Xiangxin Zhou, Jiajun Liang +5Autoregressive DiffusionRL for Video Generation

  25. RayPE: Ray-Space Positional Encoding for 3D-Aware Video Generation

    Jun 25, 2026Minghao Yin, Jiahao Lu, Wenbo Hu +3Camera-Controlled Video GenerationDiffusion Transformer