Audio Editing

Momentum

7 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 41

All topics
CardsList
  1. Smorph: Playable Sound Morphing with Diffusion Models

    Oct 5, 2026Annie Chu, Hugo Flores García, Johannes Imort +5Diffusion Model GuidanceAudio Editing

  2. End-to-End Historical Music Restoration in Latent Space

    Sep 30, 2026Steven Cho, Junghyun Koo, Raphael Lafargue +3Audio Editing

  3. Game Sound-Effect Completion with Event-Level Transformation Hints

    Sep 30, 2026Xinrui Jiang, Heng YuAudio EditingAudio Diffusion Models

  4. AVIO: Learning to Add and Remove Sounding Objects in Audiovisual Scenes

    Sep 29, 2026Weihan Xu, Kan Jen Cheng, Koichi Saito +8Audio-Video GenerationAudio Editing

  5. Spot, Separate, and Enhance: Fully Generative Approach for Audio Mixing

    Sep 24, 2026Ilpo Viertola, Giulio Cengarle, Gouthaman KV +2Audio EditingAudio Source Separation

  6. SRF-SVB: Style-Consistent Singing Voice Beautifying via Rectified Flow

    Sep 22, 2026Wenhui Li, Biao Dong, Liwei Hu +2Singing Voice SynthesisAudio Editing

  7. Synthesis and editing of multi-instrument audio mixtures using scalar-quantised latents with MIDI Span conditioning

    Sep 22, 2026Sungkyun Chang, Keshav Bhandari, Simon Dixon +1Audio EditingControllable Music Generation

  8. One-Stage Multi-Task Instruction-Guided 3D Spatial Audio Editing

    Sep 4, 2026Ke Lei, Chenyuhao Wen, Yu Zhang +9Audio EditingSpatial Audio

  9. CookVoice: Unified Framework for Style Controllable Multi-Modal Human Voice Generation

    Aug 12, 2026Haowei Lou, Hye-Young Paik, Dai Jia +2Singing Voice SynthesisTTS Synthesis

  10. Dramarrator: Object-Based Audio Editing for Audio Drama Production from Books

    Aug 8, 2026Karim Benharrak, Oriol Nieto, Bryan Wang +2Audio Editing

  11. CLASVS: Continuous-Latent Autoregression for Melody-Preserving Lyric Editing in Singing Voice Synthesis

    Aug 4, 2026Yizhong Geng, Tian-Hao Zhang, Chunfeng Wang +7Singing Voice SynthesisAudio Editing

  12. P-MUSE: Prompt-MIDI-Optional Model for Unified Instrumental Music Synthesis and Editing

    Aug 3, 2026Chong Jing, Junan Zhang, Jing Yang +3Audio EditingControllable Music Generation

  13. TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models

    Jul 30, 2026Aryan Vijay Bhosale, Harshit Rajgarhia, Abhishek Mukherji +1Audio-Language Model EvaluationAudio Editing

  14. Automatic Audio Equalization with Semantic Embeddings

    Jul 26, 2026Eloi Moliner, Vesa Välimäki, Konstantinos Drossos +1Audio Editing

  15. Dense-Sparse Dynamic Time Warping for Customizing Piano Concerto Accompaniments

    Jul 20, 2026TJ Tsai, Kavi Dey, Yigitcan Ozer +1Dynamic Time WarpingAudio Editing

  16. Neural Morphing: Sequence-Optimized Token-Level Morphing in Neural Audio Codecs

    Jul 14, 2026Emmanouil KarystinaiosAudio Editing

  17. BackgroundMellow: A Multi-Modal Cohesive Framework for Narrative-Driven Rich Cinematic Soundscape Generation

    Jul 13, 2026Ajitesh Jamulkar, Aritra HazraText-to-Audio GenerationAudio Editing

  18. A Production-Oriented Framework for Evaluation of SFX Generation

    Jul 10, 2026Mélodie Desbos, Yara Bahram, Eric Granger +1Speech Generation EvaluationAudio Editing

  19. Clean2FX: Label-conditioned modeling for clean-to-effect guitar audio transformations

    Jul 9, 2026Oliverio Bombicci Pontelli, Iran R. RomanAudio EditingConditional Generative Modeling

  20. UniSAE: Unified Speech Attribute Editing on Speaker, Emotion and Low-Level Content via Discrete Phonetic Posteriorgram Modelling

    Jun 30, 2026Chuanbo Zhu, Wuyou Zhou, Rongxiu Zhong +4Audio EditingSpeech Editing

  21. MeloDISinger: Melody-Aware & Duration-Preserving Singing Voice Editing with Audio Infilling

    Jun 29, 2026Yoonjeong Park, Jaekwon Im, Juhan NamAudio Editing

  22. Bagpiper-Edit: Zero-Shot Open-Ended Audio Editing via Rich-Caption

    Jun 19, 2026Xun Gong, Jinchuan Tian, Haoran Wang +3Audio EditingAudio Generation

  23. RFM-Editing 2: Text-Guided Audio Editing with Rectified Flow Matching and Coarse-to-Fine Diffusion Transformers

    Jun 18, 2026Liting Gao, Yonggang Zhu, Yaru Chen +5Diffusion TransformerAudio Editing

  24. RIVET: Robust Idempotent Voice Attribute Editing

    Jun 17, 2026Dareen Alharthi, Bhuvan Koduru, Rita Singh +1Audio EditingSpeech Editing

  25. Unified Audio Generation and Editing via Joint Condition Modeling and Progressive Training

    Jun 15, 2026Haocheng Dong, Yuheng Lu, Cheng Gong +3Text-to-Audio GenerationAudio Editing

  26. FreeSonic: Training-Free Temporal-Aware Decoupled Attention for Precise Audio Editing

    Jun 13, 2026Yuxuan Jiang, Mingyang Han, Yusheng Dai +12Audio EditingAudio Diffusion Models

  27. AUDEDIT: Inversion-Free Text-Guided Editing with Pretrained Audio Flow Models

    Jun 13, 2026Zhongyuan FuAudio EditingAudio Generation