Instruction-Based Video Editing

Latest papers 35

All topics
CardsList
  1. CrossEdit: Cross-Modal Training Enables Rich Audio-Visual Editing

    Oct 7, 2026William Chen, Prem Seetharaman, Ke Chen +10Instruction-Based Video EditingUnified Multimodal Models

  2. ALIVE: Interaction-Aligned Object Insertion for First-Frame-Guided Video Editing

    Oct 6, 2026Zhenghong Zhou, Zhe Lin, Jiebo Luo +1Video EditingInstruction-Based Video Editing

  3. A Spatiotemporal Semantic Importance-Guided Unified Compression and Editing Framework for AI-Generated Videos

    Oct 5, 2026Xihua Sheng, Dong Liu, Chang Wen ChenInstruction-Based Video EditingVideo Compression

  4. Reimagine Video Dynamics

    Sep 29, 2026Yu Yuan, Yawen Lu, Guoxian Song +5Disentangled Representation LearningVideo Editing

  5. Precise Editing and Flexible Referencing for Interactable Worlds

    Sep 28, 2026Xinyao Liao, Xianfang Zeng, Zhu Liang +5Instruction-Based Video EditingAutoregressive Video Generation

  6. VideoX-Qwen: Data-Centric Instruction-Based Video Editing

    Sep 22, 2026JJiahang Li, Dingbao Shao, Xinyu Chen +8Video EditingInstruction-Based Video Editing

  7. One Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing

    Sep 3, 2026Adheesh Sunil Juvekar, Onkar Kishor Susladkar, Kiet A. Nguyen +6Video EditingInstruction-Based Video Editing

  8. OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing

    Aug 5, 2026Chenxuan Miao, Yutong Feng, Yi Lu +6Video Editing BenchmarksVideo Editing

  9. CoT-Edit: Let CoT Guide Instruction Video Editing

    Aug 2, 2026Sen Liang, Fengbin Guan, Youliang Zhang +2Video Diffusion ModelsVideo Editing

  10. MEDit-Bench: A Dataset for Evaluating Message-Driven Narrative Video Editing

    Jul 28, 2026Katsuya Ogata, Zongshang Pang, Mayu Otani +1Video Editing BenchmarksInstruction-Based Video Editing

  11. EgoPlay: Event-Triggered Video Editing for Egocentric Streams

    Jul 27, 2026Jinjie Mai, Gordon Guocheng Qian, Willi Menapace +8Video Diffusion ModelsStreaming Video Generation

  12. OSVE: One Step Video Editing with One Step Diffusion Models

    Jul 22, 2026Habin Lim, Gyeong-Moon ParkVideo EditingInstruction-Based Video Editing

  13. AVE-Compass: Towards Holistic Evaluation for Audio-Video Editing Abilities

    Jul 17, 2026Yuqing Wen, Yukai Huang, Qianqian Xie +6Video Editing BenchmarksVideo Editing

  14. Consistent and Editable: A Balanced Framework for Text-Guided Video Editing

    Jul 6, 2026Tao Jin, Li XiaoVideo Diffusion ModelsVideo Editing

  15. Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing

    Jun 29, 2026Sen Liang, Cong Wang, Zhentao Yu +8Video Editing BenchmarksVideo Editing

  16. Geometry-Instructed Video Editing

    Jun 23, 2026Chirui Chang, Xiaoyang Lyu, Yi-Hua Huang +7Video EditingInstruction-Based Video Editing

  17. CoVEBench: Can Video Editing Models Handle Complex Instructions?

    Jun 7, 2026Jiangtao Wu, Jiaming Wang, Yiwen He +7Video Editing BenchmarksVideo Editing

  18. TIDE: Task-Isolated Diffusion for Unified Video Editing and Generation

    Jun 6, 2026Qi Liu, Gang Yue, Mingyu Yin +7Video Diffusion ModelsVideo Editing

  19. JAVEDIT: Joint Audio-Visual Instruction-Guided Video Editing with Agentic Data Curation

    Jun 2, 2026Yinan Chen, Chuming Lin, Zhennan Chen +12Video Editing BenchmarksTraining Data Curation

  20. Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing

    May 23, 2026Yan Li, Lin Liu, Xiaopeng Zhang +1Video Diffusion ModelsDiffusion Transformer

  21. Aurora: Unified Video Editing with a Tool-Using Agent

    May 18, 2026Yongsheng Yu, Ziyun Zeng, Zhiyuan Xiao +4Tool Use in VLMsVideo Diffusion Models

  22. InstructAV2AV: Instruction-Guided Audio-Video Joint Editing

    May 18, 2026Haojie Zheng, Yixin Yang, Siqi Yang +2Audio-Video GenerationVideo Diffusion Models

  23. Tuning-free Instruction-based Video Editing Via Structural Noise Initialization and Guidance

    May 15, 2026Song Wu, Xinyu Chen, Qian Wang +3Video Diffusion ModelsDiffusion Guidance

  24. MiVE: Multiscale Vision-language features for reference-guided video Editing

    May 14, 2026Tong Wang, Meng Zou, Chengjing Wu +4Video Diffusion ModelsVideo Editing