Video Editing

Momentum

13 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 80

All topics
CardsList
  1. ALIVE: Interaction-Aligned Object Insertion for First-Frame-Guided Video Editing

    Oct 6, 2026Zhenghong Zhou, Zhe Lin, Jiebo Luo +1Video Editing

  2. ViTeX-Bench: Benchmarking High-Fidelity Video Scene Text Editing

    Sep 30, 2026Xinghao Chen, Xiangbo Gao, Jiongze Yu +2Video EditingText-To-Video Generation Model

  3. AVIO: Learning to Add and Remove Sounding Objects in Audiovisual Scenes

    Sep 29, 2026Weihan Xu, Kan Jen Cheng, Koichi Saito +8Audio-Visual ConsistencyVideo Object Removal

  4. Reimagine Video Dynamics

    Sep 29, 2026Yu Yuan, Yawen Lu, Guoxian Song +5Video Editing

  5. Timeline-Bench: Evaluating Agents on Realistic Video-Editing Tasks, from Raw Footage to Final Cut

    Sep 28, 2026Gunin Gupta, Nirmit Arora, Pavan Kalyan TankalaVideo EditingVideo Agent

  6. VideoPhysEdit: Physical Counterfactual Video Editing via Rigid-Body Physical Scene Reconstruction

    Sep 28, 2026Conghan Yue, Yuanjie Chen, Yue Han +4Video EditingScene Understanding

  7. Joint and Cross-Modal Video-Audio Generation and Editing: A Unified Formulation and Design Taxonomy

    Sep 28, 2026Abhinav Sharma, Sai Karthik Navuluru, Wang Wei +21Audio-Video GenerationAudio-Visual Consistency

  8. Enhanced Video Text Editing with Trajectory-Aligned Glyph Rendering

    Sep 28, 2026Shulian Zhang, Xiangyu Shu, Wenbo Li +2Video EditingVideo Diffusion Models

  9. VideoX-Qwen: Data-Centric Instruction-Based Video Editing

    Sep 22, 2026JJiahang Li, Dingbao Shao, Xinyu Chen +8Video Editing

  10. Streaming Video Editing with Easy Adaptation

    Sep 21, 2026Yujia Hu, Jiajun Li, Zihao He +1Video EditingVideo Diffusion Models

  11. MDN-Control: Mask-Depth-Noise Guided Region Control for Multi-Subject Video Editing

    Sep 15, 2026Jiayi Yu, Xi Ye, Lina Wang +1Video EditingDiffusion-Based Image Editing

  12. Unified Agentic Video Editing Across Levels of Complexity and Creativity

    Sep 14, 2026Surabhi S. Nath, Kim Ferres, Milan Petrović +1Video EditingAgentic

  13. Beyond Coherence: Benchmarking Professional Editing-Technique Execution in Multi-Shot Audio-Video Generation

    Sep 8, 2026Tianyi Zeng, Junchao Liao, Yujie Wei +9Video EditingAudio-Video Generation

  14. One Editor, Many Edits: A Unified Training-Free Framework for Diverse Video Editing

    Sep 3, 2026Adheesh Sunil Juvekar, Onkar Kishor Susladkar, Kiet A. Nguyen +6Video EditingEdit

  15. RoboEdit: Turning Human Manipulation Videos into Scalable Robot Experience

    Aug 19, 2026Yaowei Guo, Zeng Tao, Yuxin Jiang +7Real-World Manipulation TasksCross-Embodiment Transfer

  16. OmniEdit-Bench: A Comprehensive Benchmark for Instruction-based Video Editing

    Aug 5, 2026Chenxuan Miao, Yutong Feng, Yi Lu +6Video EditingMulti-Dimensional Evaluation

  17. ContextMaster: Interactive Multi-Shot Video Creation via Fixed-Budget Sparse Context Routing

    Aug 5, 2026Xu Guo, Zhengxuan Wei, Xinghui Li +11Interactive Video GenerationVideo Editing

  18. Latent-Frequency Validity: Fast Spectral Editing with Screened Video-VAE Transfer Operators

    Aug 4, 2026Bowen Xue, Jiafeng Xiong, Xin QuanStar-VaeVideo Editing

  19. Crayotter: Learning Long-Horizon Video Editing Agents via Group-Relative Preference Backpropagation

    Aug 3, 2026Lecheng Yan, Jianze Lin, Yichong Zhang +5Video EditingVideo Agent

  20. CoT-Edit: Let CoT Guide Instruction Video Editing

    Aug 2, 2026Sen Liang, Fengbin Guan, Youliang Zhang +2Video EditingNeural Mask Estimation

  21. FlexComposer: Unified Video Compositing from Images to Dynamic Footage with Flexible Trajectory Control

    Jul 31, 2026Songchun Zhang, Sitong Guo, Xianghao Kong +4Video Editing

  22. MPIE-Bench: Benchmarking Anatomically Plausible Multi-Person Interaction Editing

    Jul 30, 2026Jiajia Lin, Mingxuan Du, Tuowen Zhou +2Multi-Image Editing BenchmarksHuman Mesh Recovery

  23. MEDit-Bench: A Dataset for Evaluating Message-Driven Narrative Video Editing

    Jul 28, 2026Katsuya Ogata, Zongshang Pang, Mayu Otani +1Video EditingMulti-Image Editing Benchmarks

  24. CameraAnything: Refilming Videos with Arbitrary Camera Control

    Jul 27, 2026Yixuan Li, Yanhong Zeng, Ka Leong Cheng +11Camera ControlVideo Editing

  25. EgoPlay: Event-Triggered Video Editing for Egocentric Streams

    Jul 27, 2026Jinjie Mai, Gordon Guocheng Qian, Willi Menapace +8Video EditingEgocentric Video

  26. ElasticTTT: Prior-Preserving Test-Time Tuning for Video Editing

    Jul 23, 2026Yueyi Liu, Chi Zhang, Sen Cui +1Video EditingDiffusion-Based Image Editing

  27. OSVE: One Step Video Editing with One Step Diffusion Models

    Jul 22, 2026Habin Lim, Gyeong-Moon ParkText-To-Video Diffusion ModelsVideo Editing

  28. AVE-Compass: Towards Holistic Evaluation for Audio-Video Editing Abilities

    Jul 17, 2026Yuqing Wen, Yukai Huang, Qianqian Xie +6Video EditingAudio-Visual Consistency

  29. ReBind: Multi-Reference Video Editing via Structured Instructions with Explicit Reference Relationships

    Jul 16, 2026Xinyu Liu, Shihao Li, Weihong Lin +10Video EditingEdit

  30. Goku: A Million-Scale Universal Dataset and Benchmark for Instruction-Based Video Editing

    Jun 29, 2026Sen Liang, Cong Wang, Zhentao Yu +8Video EditingVideo Dataset

  31. LiveEdit: Towards Real-Time Diffusion-Based Streaming Video Editing

    Jun 25, 2026Xinyu Wang, Chongbo Zhao, Fangneng Zhan +1Video EditingStreaming Video

  32. Geometry-Instructed Video Editing

    Jun 23, 2026Chirui Chang, Xiaoyang Lyu, Yi-Hua Huang +7Video Editing3D Editing

  33. Vera: A Layered Diffusion Model for Content-Preserving Video Editing

    Jun 22, 2026Hongkai Zheng, Ta-Ying Cheng, Benjamin Klein +2Text-To-Video Diffusion ModelsVideo Editing

  34. VideoAgent: All-in-One Framework for Video Understanding and Editing

    Jun 22, 2026Hengji Zhou, Lingxuan Huang, Jian Wang +4Video AgentVideo Editing

  35. SteerVTE: Seamless Video Text Editing with Style and Glyph Control

    Jun 22, 2026Kai Zeng, Moran Li, Zhengwei Wang +6Video EditingDiffusion-Based Image Editing

  36. IDAG-Edit: Multi-Object Video Editing via Instance-Decoupled Attention and Guidance

    Jun 20, 2026Yuan-Zhih Lin, Huu-Thang Nguyen, Huu-Phu Do +2Video EditingDiffusion-Based Image Editing

  37. Edit3DGS: Unified Framework for Dynamic Head Editing via 2D Instruction-Guided Diffusion and 3D Gaussian Splatting

    Jun 16, 2026Duy-Dat Tran, Trung-Nghia LeAnimatable 3D Human Avatars3D Editing

  38. Corpus Augmentation for Sign Language Translation via LLM-Guided Video Stitching

    Jun 10, 2026Zsolt Robotka, Ádám Rák, Jalal Al-Afandi +2Gloss-Free Sign Language TranslationSign Language Translation

  39. Beyond Consistency: Preserving Temporal Structure in Zero-Shot Video Editing

    Jun 7, 2026Deyin Liu, Yisheng Ding, Zhe Jin +3Video EditingVideo Temporal Grounding

  40. WaveDiT: Distribution-Aware Wavelet Flow Matching for Efficient 3D Brain MRI Synthesis

    Jun 7, 2026Danilo Danese, Angela Lombardi, Giuseppe Fasano +2Medical Image GenerationWavelets

  41. CoVEBench: Can Video Editing Models Handle Complex Instructions?

    Jun 7, 2026Jiangtao Wu, Jiaming Wang, Yiwen He +7Video EditingVisual Fidelity

  42. TIDE: Task-Isolated Diffusion for Unified Video Editing and Generation

    Jun 6, 2026Qi Liu, Gang Yue, Mingyu Yin +7Video EditingDiffusion Transformers

  43. Consistent-Inversion: Reverse Consistency Guidance for Structure-Preserving Visual Editing

    Jun 5, 2026Xiaocheng Lu, Jingcai Guo, Song GuoDiffusion-Based Image EditingDiffusion Inversion

  44. Bootstrap Your Generator: Unpaired Visual Editing with Flow Matching

    Jun 2, 2026Yoad Tewel, Yuval Atzmon, Gal Chechik +1Diffusion-Based Image EditingVideo Editing

  45. JAVEDIT: Joint Audio-Visual Instruction-Guided Video Editing with Agentic Data Curation

    Jun 2, 2026Yinan Chen, Chuming Lin, Zhennan Chen +12Video EditingVideo Dataset

  46. AlbedoEdit: Unified Instance-Level Video Editing with Albedo Guidance

    May 31, 2026Xilong Zhou, Bao-Huy Nguyen, Zheng Zeng +6Video EditingVideo Foundation Models

  47. Crayotter: Traceable Multi-Agent Workflows for Long-Form Video Editing

    May 31, 2026Lecheng Yan, Yichong Zhang, Ben Pan +5Video EditingVideo Agent

  48. CV-Arena: An Open Benchmark for Instructional Computer Vision Problem Solving with Human-AI Collaborative Preferences

    May 30, 2026Fangzhou Lin, Peiran Li, Lingyu Xu +12Computer VisionVideo Editing

  49. SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer

    May 28, 2026Yuyang Zhao, Yicheng Pan, Qiyuan He +6Video EditingStreaming Video

  50. SpongeBob: Sync-Aware Harmonious Audio-Visual Generative Editing

    May 24, 2026Sen Liang, Cong Wang, Fengbin Guan +6Audio-Visual ConsistencyAudio-Video Generation

  51. Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing

    May 23, 2026Yan Li, Lin Liu, Xiaopeng Zhang +1Video EditingDiffusion-Based Image Editing

  52. SimInsert: Seamless Video Object Insertion via Regional Sparse Attention Fusion

    May 22, 2026Xinyu Chen, Yuyi Qian, Jiang Lin +9Video EditingDiffusion-Based Image Editing

  53. Occlusion-Aware Physics-Semantic Keyframe Selection for Robust Video Editing

    May 22, 2026Lin Liu, Zhihan Xiao, Haohang Xu +4Video EditingKeyframe Selection

  54. StreamEdit: Training-Free Video Editing via Few-Step Streaming Video Generation

    May 20, 2026Guanlong Jiao, Chenyangguang Zhang, Jia Jun Cheng Xian +2Video EditingDiffusion-Based Image Editing